Добавил:
ivanov666
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз:
Предмет:
Файл:Социология современного образования. Учебник
.pdf
14.3. Формирование выборки в социологическом исследовании 381
Сама программа является серьезной частью научной работы и может быть опубликована как самостоятельная научная работа. Публикация программы подобна передаче лицензии на производство научного знания.
Рабочий план исследования – органическая часть любой программы. В нем поэтапно намечаются сроки проведения работы, если
нужно, фиксируются исполнители, составляется смета расходов,
обосновывается численность сотрудников. Здесь определяются сроки представления предварительных и итоговых результатов исследования. При организации прикладного исследования важно четко
уяснить, что ожидает заказчик от планируемого исследования и что,
с точки зрения социологов, может быть реализовано точно, что предположительно, а что и вовсе не удастся выполнить. Если цель, задачи
и возможные результаты не будут согласованы с заказчиком, могут
возникнуть проблемы при подведении итогов.
Примерное распределение рабочего времени на организацию социологического исследования:
разработка программы – 30–40 %;
сбор информации – 10–15 %;
подготовка данных к компьютерной обработке – 10–15 %;
обработка данных – 5–10 %;
анализ материалов, написание отчета – 30–40 %.
Конечно, такая структура не является обязательной. Все зависит от
глубины и масштабов исследования, как, впрочем, и от опыта, научной интуиции социологов, авторитета научного руководителя. Это как
с неполадками автомобиля: для начинающего любителя ликвидация
любой, даже самой незначительной поломки превращается в серьезную проблему: для начала он заглядывает в инструкцию по уходу и ремонту, потом обращается на станцию технического обслуживания,
диагностирует работу двигателя на стенде и т.п. В той же ситуации
опытному автомобилисту достаточно послушать работающий двигатель, чтобы определить проблему, а то и сразу устранить поломку.
14.3. Формирование выборки
в социологическом исследовании
Способы формирования выборочной совокупности. Прежде всего,
отметим, что выборки делятся на три больших класса: сплошные
(переписи, референдумы) и монографические (небольшой объект);

382 Глава 14. Методология и организация социологических исследований
случайные (вероятностные); неслучайные (выбор по усмотрению,
целевые). Со сплошными (монографическими) и целевыми выборками все достаточно просто, и мы рассмотрим их ниже.
Сложнее обстоит дело с двумя другими классами. Каждый из них
содержит несколько видов (типов). К случайным относят: собственно случайную (вероятностную), систематическую, районированную
(стратифицированную, или выбор слоями), выбор гнездами (серийную). К не случайным относят: «стихийную», квотную, метод «основного массива», целенаправленный выбор.
Случайный выбор – основная форма вероятностной выборки,
когда все элементы генеральной совокупности имеют одинаковую
вероятность попасть в выборочную совокупность. Для этого используется несколько приемов: отбор по принципу лотереи; отбор с помощью генератора (таблицы) случайных чисел; отбор на основании
какой-либо системы, например по точному шагу (интервалу). Его
величина определяется по формуле К = N / n, где N = ГС, n = V (объем выборки). Для чисто случайной выборки (ЧСВ) требуется точные
списочные данные обо всех единицах генеральной совокупности. На
практике ЧСВ часто используется в локальных социальных исследованиях при более или менее однородной основе выборки. В связи
с этим чисто случайная выборка обычно применяется в качестве завершающей ступени отбора (при сведении отобранных единиц к однородности) в сложных многоступенчатых выборках.
Если выборка велика, для получения более однородной структуры единиц отбора приходится разделять обследуемую совокупность
на более или менее однородные части, а затем осуществлять отбор
единиц внутри этих частей. Если деление происходит по стратам
(социальным группам), то выборку именуют стратифицированной,
если по экономико-географическим или территориальным районам – районированной.
Организация районированного отбора требует знания конкретной информации о наличии в генеральной совокупности тех признаков, которые должны быть положены в основу типических групп,
т.е. признаков районирования (данные переписей, избирательных
комиссий). Отбор элементов из генеральной совокупности, разделенной на слои или районы, осуществляется с помощью следующих
приемов: пропорционального отбора, когда из каждого слоя берут
нормированную процентную ставку (например, 5 %); диспропорционального или оптимального отбора, цель которого получить максимальную однородность элементов внутри каждой группы отбора.

14.3. Формирование выборки в социологическом исследовании 383
Чем однороднее слой генеральной совокупности, тем больше элементов этого слоя попадет в выборку.
Гнездовая, или серийная, выборка – вид выборки, при котором
отбираемые объекты представляют собой гнезда (кластеры) совокупности более мелких, статистически различимых единиц отбора.
Такими единицами, или гнездами, могут быть семья, группа, класс,
бригада. Выбор гнезд осуществляется по правилам чисто случайной
выборки, по соответствующим спискам, а сами гнезда, попавшие
в выборку, подвергаются сплошному обследованию. Особенности
гнездовой выборки: каждый элемент выборки должен принадлежать
одному гнезду; гнезда должны быть однотипными (например, бригаду не путать со сменой); гнездо должно иметь естественный (реальный) состав. Имея простой механизм отбора, данный тип выборки
особенно эффективен для естественных гнезд (семья, группа и т.д.),
так как такие гнезда, как правило, сконцентрированы в одном месте.
Соединение в многоступенчатой выборке различных типов отбора (ЧСВ, районированной и серийной) делает ее комбинированной.
Это возможно, если генеральная совокупность имеет обозримый объем, где единицы отбора удается пронумеровать (систематизировать),
и каждая из них получает равную вероятность попасть в выборку.
Упрощенным вариантом чисто случайной выборки является систематический отбор. Используется таблица случайных чисел, алфавитные списки класса, организации (картотека всегда есть в отделе
кадров) или избирательного участка (при опросе по месту жительства). Процедура систематического отбора проста: количество единиц генеральной совокупности, предположим 2000 работников
предприятия, делится на объем выборки (200 единиц), и определяется шаг выборки. Он предполагает, что, начиная с любого номера,
случайным образом определенным из списка, опрашивается каждый
десятый (2000 : 200 = 10), что обеспечивает равновероятное попадание в выборку каждой единицы генеральной совокупности.
Весь изучаемый социальный массив социологи называют генеральной совокупностью. Конечно, для исследования берется какаято часть, как при анализе крови берется одна капля. Весь вопрос
в том, как отобрать эту часть.
Любое единичное наблюдение распространяется на более широкую сферу наблюдений, и проблема репрезентации заключается
в том, чтобы установить степень соответствия между параметрами
обследованной совокупности и «реальными» характеристиками объекта. Выборочная совокупность, с которой непосредственно «сни-

384 Глава 14. Методология и организация социологических исследований
маются» данные, порождается процедурой, но в то же время она
растворена в большой совокупности, которую представляет или репрезентирует с разной степенью точности и надежности. Выборочная
процедура предназначена как раз для того, чтобы реконструировать
реальный объект исследования и генеральную совокупность из отдельных моментных наблюдений. Объект исследования не совпадает
с генеральной совокупностью примерно так же, как карта местности
не совпадает с самой местностью.
Выборка – это стандартный метод исследования, когда из общей
изучаемой (генеральной) совокупности однородных единиц отбирается некоторая ее часть (выборочная совокупность), и только эта
часть подвергается обследованию.
Социолог выделяет некую часть генеральной совокупности в надежде, что сумеет выявить и доказать свойства всего объекта исследования в целом. Тип и способ выборки зависят от целей исследования
и гипотез: чем конкретнее цель и яснее сформулированы гипотезы,
тем правильнее будет решен вопрос о выборке. Выборка производится из той совокупности, из которой производится фактический
отбор респондентов. Она называется реальной.
Целевой называется выборка, в которой идет выделение на основе
каких-либо признаков, например по полу, национальности, имущественному положению, принадлежности к политическим партиям и т.п.
Целенаправленная квотная выборка предполагает пропорциональный отбор на основании статистики распределения среди генеральной совокупности заданных сочетаний паспортных данных
респондентов – квот. В социологии также используется выборка
как метод основного массива – опрос всех присутствующих (или
60–70 % всей численности). Посредством этого метода, например,
осуществляется «зондаж» общественного мнения.
Выборки бывают одноступенчатыми и многоступенчатыми, комбинированными. На каждой ступени отбора следует обеспечить условие представительности. Например, при опросе населения города
на первом этапе отбираются типичные микрорайоны, а затем опрашиваются жители каждой двадцатой или пятидесятой квартиры,
дома. При опросе населения области, страны на первой ступени выбираются типичные районы и города.
Примером стихийной выборки могут быть опросы по почте, интервью прохожих, пассажиров. Здесь может применяться квотный
принцип, когда в конкретном здании необходимо опросить опреде-

14.3. Формирование выборки в социологическом исследовании 385
ленное количество человек по некоторым признакам, к примеру по
полу, возрасту.
Различия между проектируемой и реальной совокупностями
можно увидеть воочию, сравнив списки опрошенных и запроектированных респондентов. Реальный объект опроса – та совокупность, которая сформировалась на стадии полевого исследования
с учетом ограничений в доступности первичной социологической
информации.
Предположим, N – генеральная совокупность, обладающая среднестатистической характеристикой x
. Это может быть средний воз-
ген
раст, доход, доля консерваторов или либералов, количество людей,
испытывающих в настоящий момент счастье, оптимизм. Предположим далее, что из генеральной совокупности N отобрана совокупность n – выборочная, которая обладает средней характеристикой
х
. Ясно, что n < N. Тогда задача заключается в сопоставлении x
выб
и х
. Отклонение выборочной средней от генеральной средней на-
выб
ген
зывается ошибкой выборки:
xx
выб ген
.
Из формулы следует, что исчисление Δ – ошибки выборки является принципиально неосуществимым, если неизвестны значения
переменной в выборочной n и генеральной N совокупностях. Так
возникает замкнутый круг: чтобы установить значение генеральной
средней, нужно построить выборку, но, даже реализовав выборку,
мы не сможем определить ее ошибку, потому что не знаем генеральной средней. Если бы мы знали генеральную среднюю, задача определения ошибки выборки решалась бы просто, но в данном случае
выборка была бы просто не нужна. Практически ошибка выборки
определяется путем сравнения известных характеристик генеральной совокупности с выборочными средними.
В социологической практике расчет ошибки выборки, как прави-
100
193
:
%,
ло, проводится по формуле В. Паниотто
11
nN
где: nΔ – ошибка выборки, n – объем выборки, человек, N – объем
генеральной совокупности, человек.
193
Паниотто В. И. Качество социологической информации. Киев, 1986. С. 81.

386 Глава 14. Методология и организация социологических исследований
Например, Тюменский государственный университет на рубеже
веков проводил социологическое исследование в рамках программы
«Неформальная экономика». За объем генеральной совокупности N
была взята численность постоянного населения Тюменской области
без автономных округов в трудоспособном и старше трудоспособного возрасте. Объем выборки определялся аналитическими задачами
исследования, ее репрезентативность – целевой установкой программы, расчет ошибки выборки проводился по формуле Паниотто
следующим образом:
11
100
%,%.
nN
1
241011071900
203
Полученная ошибка выборки по одному признаку составляет 2,03 %,
что свидетельствует о повышенной надежности исследования.
Всего было опрошено 2410 человек – жителей Тюмени и юга области. Распределение опрошенных по полу и возрасту представлено
в табл. 14.1.
Таблица 14.1
Распределение опрошенных по полу и возрасту
(проект ТюмГУ «Неформальная экономика», 2003–2004 гг.)
Возраст, лет
18–25
26–30
31–35
36–40
41–45
46–50
51–55
56–60
Старше 60
Всего 1073 (44,6) 1332 (55,4) 2405 (100)
Мужчин Женщин Всего
Число опрошенных, человек (%)
193
148
186
150
158
137
60
23
18
222
175
180
190
230
181
78
37
39
415 (17)
323 (14)
366 (15)
340 (14)
388 (16)
318 (13)
138 (6)
60 (3)
57 (2)
Поскольку разделение респондентов по занимаемой позиции на
рынке труда было принципиально важно для анализа взаимоотношений работодателей и работников, и особенно для выявления степени
их включенности в неформальные практики и их отношения к неформальной (нерегистрируемой) занятости, вся выборка была разде-

14.3. Формирование выборки в социологическом исследовании 387
лена на подвыборки по позициям, занимаемым на рынке труда: работодатели, наемные работники с высшим образованием, наемные
работники без высшего образования, неработающие (табл. 14.2).
Таблица 14.2
Распределение опрошенных по позициям, занимаемым на рынке труда
(проект ТюмГУ «Неформальная экономика», 2003–2004 гг.)
Респонденты
Работодатели
Наемные работники с высшим образованием
Наемные работники без высшего образования
Неработающие
Число опрошенных,
человек (%)
383 (16,0)
970 (40,5)
779 (32,5)
265 (11,0)
Всего 2397 (100)
По формуле В. И. Паниотто получаем ошибку выборки для Тюмени.
Другой реальный пример. В 2006 г. Тюменский государственный
университет проводил социологическое исследование по изучению
аудитории тюменских СМИ по заказу городской администрации.
Целью этого исследования было получение объективной информации об аудитории печатных и электронных СМИ города Тюмени.
В главные задачи исследования входило:
определение рейтинга популярности печатных и электронных
СМИ г. Тюмени;
выявление уровня информированности горожан о жизни города
и области, деятельности городских и областных органов власти;
определение социально-демографических характеристик целевой
аудитории конкретных СМИ;
изучение степени доверия населения к наиболее популярным тю-
менским СМИ;
определение рейтинга популярности новостных теле- и радио-
программ;
выявление наиболее предпочитаемых временных интервалов для
просмотра и прослушивания тюменских телерадиопрограмм;
определение рейтинга известности и доверия к ведущим тюмен-
ским журналистам;
изучение актуальности тематики новостных теле- и радиопро-
грамм.

388 Глава 14. Методология и организация социологических исследований
Помимо этого, система изучения общественного мнения и оценки рынка СМИ должна включать в себя решение следующих взаимосвязанных дополнительных задач: изучение аудитории различных
СМИ, определение потребностей аудитории для развития содержания СМИ, построение рейтингов на основе сравнения их аудитории,
определяющих главным образом достижимость целевых аудиторий;
изучение возможности сбыта печатных СМИ, определение потребностей аудитории для развития электронных СМИ.
Результаты изучения общественного мнения и оценки рынка
СМИ должны быть направлены на выработку конкретных рекомендаций по развитию информационной политики органов региональной (муниципальной) власти, созданию единого информационного
пространства, повышению эффективности взаимодействия между
органами власти и населением.
Объект исследования – жители г. Тюмени. Объем выборки составил 5600 человек в разрезе 16 избирательных округов по 350 человек
в каждом. Объем выборки включал в себя не менее 1,3 % взрослого (18
лет и старше) населения Тюмени. Единицей выборочной совокупности являлся житель Тюмени, проживающий в городе. Выборка формировалась квотным способом с репрезентацией взрослого населения Тюмени по полу и возрасту. Ошибкой выборки оценивалась мера
подобия выборочной модели структуре генеральной совокупности.
Для Тюмени получаем по формуле Паниотто следующую ошибку
выборки:
11
13
,%,
nN
где: Δ – ошибка выборки; n – объем выборки (5600 человек);
N – объем генеральной совокупности (490 000 человек).
Полученная ошибка выборки по одному признаку для всего массива составила 1,3 %, что обеспечивает повышенную надежность исследования.
Для одного округа по Тюмени получаем по формуле Паниотто
следующую ошибку выборки:
1
53,%,
350130625
где: Δ – ошибка выборки; n – объем выборки по одному округу –
350 человек, задан заказчиком; N – объем генеральной сово-

14.3. Формирование выборки в социологическом исследовании 389
купности по одному округу Тюмени – в среднем около 30 625
человек (49 000 : 16).
Полученная ошибка выборки по одному признаку по одному округу города Тюмени в нашем исследовании составляет около
5,3 %, что обеспечило среднюю стандартную (Δ5 %) надежность исследования.
Половозрастные параметры выборки были определены заказчиком. В случае перекосов (смещения) половозрастных данных в ходе
опроса заполненная анкета браковалась, и полевая часть исследования возобновлялась. Всего таким способом было забраковано порядка 400 анкет, т.е. в среднем около 25 анкет на округ. Хотя на самом
деле в одних округах перекосов было значительно меньше из-за изначально качественного опроса, в других округах перекосов и, соответственно, проблем со способом поиска объектов опроса было больше.
Другие важные для соблюдения высокой репрезентативности социально-демографические параметры выборки, такие как образование,
вид деятельности, сфера деятельности, квалификационный статус,
материальное положение, конкретная территория проживания, контролировались в ходе конкретных полевых работ.
Методы эмпирического исследования: поквартирный опрос посредством личного интервью с респондентом по месту его жительства с последующей тройной перекрестной проверкой факта опроса.
Реально получившаяся характеристика выборки по половозрастному составу абсолютно точно репрезентовала параметры генеральной
совокупности. Нормальность распределения по половозрастному
составу подтвердили тесты Колмогорова – Смирнова и Шапиро –
Вилка, которые дали величину ошибки, меньшую 0,01 %, на максимальном уровне значимости как по всей выборке, так и по каждому
округу в отдельности.
В социологии при обследованиях взрослого населения чаще всего используют данные переписей населения, текущего статистического учета, предшествующих опросов на том же объекте. В качестве
контрольных параметров применяются социально-демографические признаки. Это можно сделать по завершении анализа данных.
Исключение составляют предвыборные опросы и опросы, предшествующие переписям населения и референдумам, – исследователи
стремятся предсказать их результаты и подтвердить репрезентативность своих данных. В США институт Дж. Гэллапа систематически
проводит обследования общественного мнения по национальной
выборке объемом 1500 человек, контролирует репрезентативность

390 Глава 14. Методология и организация социологических исследований
по имеющимся в национальных цензах данным о распределении
населения по полу, возрасту, образованию, доходу, профессии, расовой принадлежности, месту проживания, величине населенного
пункта.
Генеральная и выборочная совокупности должны сопоставляться
по некоторым важным признакам, которые легко проверяются статистическими методами. Если они совпадают, то выборка называется представительной, репрезентативной. Чем больше размер выборки, тем больше и достоверность, репрезентативность.
Прежде всего, надо уяснить, какие из имеющихся сведений о характеристике генеральной совокупности, объекте исследования
существенны для целей исследования. Во многих случаях это половозрастной, социально-профессиональный, имущественный состав обследуемых, их пространственная локализация. Пол и возраст
замыкают на себе многие показатели семейного состояния: возраст,
например, указывает на жизненный опыт, профессиональный стаж.
Пространственная локализация (по территории проживания, по месту работы) важна с точки зрения адресности выводов и рекомендаций, которые должны быть привязаны к административным или
производственным объектам.
При сочетании этих трех параметров – половозрастной структуры, социального состава и пространственной локализации – можно
быть уверенным, что выборка будет представительной для изучения многих социальных проблем. Понятно, что это правило имеет
исключения в зависимости от конкретных условий и особых целей
исследования. Например, при изучении политических ориентаций
населения не обойтись без учета имущественного положения, а студенческих проблем – без знания вуза и курса обучения студентов.
Иногда требуется повышенная надежность, например в экономических и демографических исследованиях, при переписях населения. Здесь даже несущественные отклонения в конечном счете
могут давать большие ошибки. Отклонение выборки от известных
показателей генеральной совокупности считается в процентах. Повышенная надежность выборки допускает ошибку (Δ) до 3 %, обыкновенная – от 3 до 10 %, приближенная – от 10 до 20 %, ориентировочная – от 20 до 40 %.
При этом следует иметь в виду, что при изучении определенной
группы населения, например ветеранов, репрезентативная выборка заменяется целевой. Она, будучи представительной в отношении
Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]
