Добавил:
ivanov666
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз:
Предмет:
Файл:Методы выборочного обследования. Учебное пособие
.pdf
надежных сводных показателей по отдельным группам единиц совокуп-
Возрастные группы, лет
Структура населения)
2
, %
Численность обследуемого
населения по структуре, чел.
Структура потребления
пропорциональная, %
Распределение населения по
пропорциональной
структуре, чел.
Потребление зубной пасты
исходя из пропорциональной
структуры, шт.
Потребление зубной пасты
исходя из структуры населения
(по данным переписи), шт.
Поправочный
коэффициент = 5000/гр. 7
Потребление зубной пасты с
учетом поправочного
коэффициента, шт.
До 70
5
250
16,7
833
3333
1000
0,3
999,9
До 60
10
500
16,7
833
3333
2000
0,6
1999,8
До 50
10
500
16,7
833
3333
2000
0,6
1999,8
До 40
30
1500
16,7
833
3333
6000
1,8
5999,4
До 30
30
1500
16,7
833
3333
6000
1,8
5999,4
До 20
15
750
16,7
833
3333
3000
0,9
2999,7
Итого
100
5000
100
5000
20000
20000
1,0
19998
ности. Существенным недостатком этого способа является тот факт, что
возникает необходимость дополнительной корректировки полученных
итогов для восстановления фактических соотношений между всеми группами единиц по генеральной совокупности в целом.
Пример распределения и корректировки по первому и второму
способам приведен в табл. 3.
Таблица 3
Распределение потребления зубной пасты (двумя способами)
по структуре населения и в равных долях
Предположим, что мы хотим определить уровень потребления
зубной пасты среди населения. В выборку попало 5000 человек, которые потребили 20000 тюбиков зубной пасты в год. При использовании
электронных технологий обработки информации система введения весовых коэффициентов реализуется вполне успешно.
2
По данным последней переписи населения
41
41

При квотном отборе формирование состава единиц, включаемых
в каждую группу, осуществляется в ходе обследования. Интервьюеры
в ходе обследования и сбора информации могут контролировать степень заполнения групп. Как только группа укомплектована необходимым числом единиц, отбор прекращается. Переписчикам приходится
отказываться от желающих участвовать в обследовании, хотя они по
своим характеристикам подходят к данной группе, но обследование по
ним уже завершено.
Как правило, в обследовании работает немалое количество переписчиков, и их деятельность необходимо постоянно координировать в целях
предотвращения избыточного числа обследованных единиц по группам.
Это является существенным недостатком квотного отбора и требует дополнительных человеческих ресурсов в виде координаторов. Кроме того,
отбор респондентов осуществляется лично интервьюером, что ведет
к систематической ошибке смещения в процессе отбора, при этом нет
никакой возможности определить величину этого смещения.
Преимуществом квотного отбора является то, что единицы отбора
сосредоточены в небольшом пространстве, это сокращает временные
и финансовые расходы и, как правило, обеспечивает хорошую репрезентативность, если структура квоты точная. Квотный отбор обычно
применяют тогда, когда нет возможности провести более затратное обследование, результаты такого обследования не предусматривают
жестких требований относительно точности полученных результатов и
не используются для принятия ответственных решений. Чаще всего
квотный отбор, как и анкетный, используется для изучения общественного мнения или социологического опроса.
Точность результатов обследования при использовании квотного
отбора зависит от тщательности проведенной группировки единиц генеральной совокупности – полноты охвата наиболее существенных
признаков и обоснованности решения о числе и границах интервалов
по каждому признаку.
Типический отбор – это такой метод несплошного наблюдения,
при котором изучаемая статистическая совокупность группируется
по типическому признаку. В результате можно получить достаточно
однородные группы, затем из этой группы случайным способом выбирается заданное количество единиц. Широкое распространение
этот метод имел в прошлом. В России земская статистика использовала этот метод для отбора крестьянских хозяйств и личных подсоб-
42
42

ных хозяйств в сельской местности. Определялись наиболее типичные для исследуемой генеральной совокупности группы, которые
и становились объектом обследования. Отбор, как правило, производился специалистом, проживающим в этом или близлежащем населенным пункте и хорошо знающим, какие из них соответствуют критериям типичности. Раньше в России уезды разделялись на округа, из
округов выбирались селения с соответствующими признаками.
Например, при обследовании сельскохозяйственных волостей Терской губерния (когда-то создана для народов Северного Кавказа) обследуемая совокупность формировалась на основании экспертных
оценок специалистов. Специалист-эксперт знал, какие селения занимаются выпасом скота в горах, или производством овечьего сыра, или
выращиванием виноградников и т. п. С одной стороны, такой отбор
мог обеспечить хороший результат, в силу того что в выборку попадали представители всех типических групп, но с другой стороны, существенным недостатком данного метода являлось то, что формирование выборки зависело от субъективизма эксперта. В настоящее
время такой вид отбора в российской статистике практически не применяется.
Цензовый отбор (метод основного массива) применим лишь в случае значительной дифференциации единиц генеральной совокупности
по своим размерам. Обследованию подлежат только достаточно крупные единицы. Устанавливается критерий отбора (ценз, опись) – числовые значения одного или нескольких признаков. Обследуются те единицы совокупности, за счет которых формируется основная часть совокупного итога по генеральной совокупности в разрезе каждого показателя. Например, при обследованиях хозяйствующих субъектов задается
определенное критическое число занятых на предприятии. Предприятия с числом работников более или менее этого критического числа
в объект обследования не попадают.
Цензовый отбор применяется при обследовании населенных пунктов и хозяйствующих объектов. Необходимо помнить, что результаты
цензового отбора нерепрезентативны для всей генеральной совокупности. Итоги такого обследования могут характеризовать только ту его
часть, которая соответствует установленному цензу.
В настоящее время в российской практике цензовый отбор зачастую комбинируется с выборочным обследованием. Выборочно обследуется та часть, которая осталась не охвачена цензовым обследованием.
Интеграция двух обследований позволяет получить итоги, которые
43
43

максимально соответствуют всей генеральной совокупности. Недоучет
информации компенсируется корректировкой итоговых показателей
с помощью поправочных коэффициентов.
Характерным примером цензового отбора может служить обследование субъектов хозяйственной деятельности. Средние и крупные
организации обязаны предоставлять статистическую отчетность в порядке сплошного наблюдения. Малые предприятия обследуются по сокращенной программе в выборочном порядке.
Направленный отбор – отбор единиц из генеральной совокупности по какому-либо одному или двум, или нескольким заранее установленным признакам.
Это делается для того, чтобы была возможность для более глубокого изучения взаимосвязанности известных признаков с менее изученными фактами. Например, если для изучения распространенности заболевания можно сформировать однородные группы по возрастному фактору и полу граждан, то можно понять и исследовать образ жизни этих
групп. При этом влияние пола и возраста исключаются.
Направленный отбор – достаточно широкое понятие, охватывающее ряд различных видов несплошного наблюдения, это может быть
цензовый отбор, типический отбор. Основная задача такого отбора заключается в получении расширенной информации по изучаемой совокупности с целью ее дальнейшего анализа и последующего глубокого
и многостороннего изучения.
Выборочны метод обследования является основным научно обоснованным методом несплошного наблюдения. Его отличительные особенности:
– обеспечивается строгое соблюдение принципа случайности отбора;
– используется математический аппарат теории вероятностей для
определения теоретических значений ошибок репрезентативности или
для расчета объема выборки, при котором гарантируется необходимая
мера точности итоговых показателей;
– при распространении выборочных данных на генеральную совокупность можно с заданной вероятностью установить границы, в которых находятся вычисляемые показатели по генеральной совокупности;
– имеется возможность на стадии проектирования выборочного
обследования заранее предусмотреть такие условия формирования выборочной совокупности, при которых обеспечивается необходимая точность результатов обследования;
44
44

– существует возможность получения более точных результатов, чем при сплошном обследовании, так как резко сокращаются
ошибки наблюдения и минимизируется величина ошибки репрезентативности;
– достигается максимальное приближение структуры выборочной
совокупности к структуре генеральной совокупности.
В математической статистике дается следующая формулировка
выборочного метода: «Выборкой из совокупности объема N называется подмножество из n элементов этой совокупности, которые отобраны случайным образом. Каждый элемент совокупности имеет
определенную фиксированную вероятность быть отобранным».
Из данного определения следует, что основным и строго обязательным признаком выборочного метода является случайный порядок отбора единиц выборочной совокупности. Обратите отдельное внимание на это высказывание, поскольку в нем заложена сущность понимания выборочного метода.
Недостаточно компетентные люди в вопросах статистической методологии нередко приравнивают понятия «несплошное» и «выборочное» наблюдение.
Выборкой является вся совокупность отобранных в выборочном
порядке малых предприятий. Если же затем из этой выборки некоторые
предприятия отбираются «экспертно», «случайно», то в математическом смысле это не выборочный метод, а типический отбор.
Выборка не может считаться вероятностной, а обследование не
может считаться выборочным в следующих случаях:
– отбор ограничен только доступной для наблюдения частью генеральной совокупности;
– отбор производится беспорядочно, наугад;
– отбираются единицы, наиболее типичные для данной совокупности (по мнению эксперта или исследователя);
– отбираются единицы с заранее заданными параметрами;
– в число обследуемых включаются единицы, изъявившие желание участвовать в предстоящем исследовании.
В социально-экономической статистике каждый из невероятностных способов отбора может оказаться приемлемым и даже эффективным в случае, если ставится определенная цель и ее хотят достигнуть.
45
45

К о н т р о л ь н ы е в о п р о с ы
1. Какое обследование называется несплошным?
2. Основные требования, предъявляемые к результатам статисти-
ческих исследований.
3. При каком виде обследования (сплошном или несплошном)
легче следовать этим требованиям?
4. Какие виды несплошного обследования вы знаете?
5. Дайте характеристику каждому из методов несплошного
наблюдения. Назовите сильные и слабые стороны каждого из них.
6. Какой из известных вам видов несплошного обследования явля-
ется предпочтительным и почему?
О с н о в а в ы б о р к и
Для того чтобы расширять сеть выборочных обследований в статистике, необходимо решать определенные методологические и технические проблемы по созданию такой базы данных, где можно было бы
найти информацию обо всех единицах генеральной совокупности. Мы
должны понимать, что, прежде чем планировать проведение выборочного обследования, необходимо иметь список всех объектов, из которых можно будет произвести выборку единиц совокупности.
В статистике выборочного обследования такой список называется
основой выборки. Так, если есть необходимость изучить качество образования в начальных средних школах, то генеральной совокупностью
будут являться все школы страны. Основой выборки является полный
перечень школ, содержащий адресные данные и по возможности краткие сведения о каждом из них.
Все выборочные обследования, которые проводятся в органах государственной статистики, можно разделить на два направления: первое – это население, второе – это субъекты хозяйственной деятельности. Следовательно, необходимо иметь две системы баз данных, которые могут быть использованы в качестве основы выборки.
В российской государственной статистике существуют и используются в практике выборочных обследований указанные два типа баз
46
46

данных. При изучении различных аспектов хозяйственной деятельности в качестве материалов для создания основы выборки используются
данные Единого государственного регистра предприятий и организаций (ЕГРПО). Для обследований населения основа выборки формируется по материалам последней Всероссийской переписи населения.
К базам данным такого рода предъявляются определенные требования, и они должны быть соблюдены. Для обеспечения достоверности
полученных итоговых данных базы данных должны иметь полноту
охвата (все действующие субъекты должны быть включены в перечень). Вся информация в базе данных должна быть обеспечена методологическим единством для применения информационных технологий
при работе с массивом этих данных. Всю информацию, содержащуюся
в базе данных, необходимо своевременно актуализировать в соответствии с происходящими изменениями (предприятия образуются, закрываются, меняют вид деятельности, адреса и т. п.), она должна быть понятна и доступна для работы пользователям.
«Одним из наиболее полноценных источников такой информации являются материалы сплошных Всероссийских переписей хозяйствующих субъектов и населения. В соответствии с программой развития государственной статистики на период 2007–2011 гг. одной из
крупнейших работ считалось создание на основе информационного
массива Всероссийской переписи населения 2002 г. территориальной
выборки многоцелевого назначения, на базе которой, в свою очередь,
будут формироваться выборочные совокупности».
Качественной основой выборки, в которой единицей совокупности является человек, в будущем может стать Государственный автоматизированный регистр населения (ГАРН). Справедливости ради необходимо отметить, что такой регистр не был создан ни по материалам
переписи 2002 г., ни по материалам переписи 2010 г.
Пока такого регистра населения не существует, чаще всего используются данные регистрации населения по месту проживания,
списки избирателей.
Для проведения выборочного обследования хозяйствующих субъектов используется ЕГРПО как база для формирования основы выборки. На основе ЕГРПО создается база данных «Генеральная совокупность объектов статистического наблюдения».
В качестве единицы генеральной совокупности выступают хозяйствующие субъекты, осуществляющие свою деятельность на территории Российской Федерации, прошедшие государственную регистрацию
47
47

и обязанные представлять в органы государственной статистики статистическую и (или) бухгалтерскую отчетность:
– юридические лица;
– филиалы и представительства юридических лиц;
– хозяйствующие субъекты без права юридического лица (индивидуальные предприниматели).
«Генеральная совокупность объектов статистического наблюдения» имеет сложную структуру. В ее состав входят два раздела:
– территориальный раздел с данными по каждому субъекту Российской Федерации;
– отраслевой раздел, в котором объекты систематизированы по основному виду деятельности.
На базе «Генеральной совокупности объектов статистического
наблюдения» создаются субрегистры объектов:
Если из ЕГРПО сделать выборку только промышленных предприятий, то получим субрегистор промышленных предприятий, если создать выборку по виду деятельности «торговля», то можно получить
субрегистр предприятий розничной торговли и т. д. Формирование субрегистра происходит в автоматизированном режиме, главное, чтобы
предприятия в ЕГРПО имели определенные идентификационные коды
видов деятельности в соответствии с классификатором видов экономической деятельности (ОВКЭД).
В «Генеральной совокупности объектов статистического наблюдения» представлены следующие блоки информации:
1. Наименование и код по Классификатору видов экономической
деятельности (ОКВЭД).
2. Коды по общероссийским классификаторам административнотерриториального деления, органов государственной власти и управления, отраслей народного хозяйства, форм собственности и организационно-правовых форм.
3. Адрес, дата государственной регистрации, ИНН, данные о наличии лицензии на право занятия определенным видом деятельности
и другая справочная информация.
4. Экономические показатели – среднесписочная численность
персонала, выручка от реализации продукции (работ, услуг).
5. Прочая технологическая и нормативно-справочная информация.
48
48

М н о г о ц е л е в а я о с н о в а в ы б о р к и
( с п о с о б ы ф о р м и р о в а н и я )
Проводимые в стране обследования населения в целях изучения
демографических, социальных, экономических процессов объединяет
то, что в качестве объекта наблюдения в них выступает население – индивиды, брачные пары, семьи, домохозяйства. В этих условиях целесообразно сформировать единую для всех обследований населения основу выборки, используя уже имеющиеся массивы информации по генеральной совокупности, представленные материалами переписей
населения. Крупномасштабное использование в качестве основы выборки данных переписи населения было осуществлено в нашей стране
при проведении микропереписей населения в межпереписные периоды.
Материалы переписи населения 1979 г. явились основой выборки при
проведении микропереписи 1985 г., охватившей 5 % населения страны.
Данные переписи населения 1989 г. были представлены уже на
электронных носителях, что существенно облегчило процедуру отбора.
Сформированная на основе материалов переписи 1989 г. выборка использовалась:
– для формирования подвыборки в целях проведения обследований населения по проблемам занятости, которые осуществляются
с 1992 г. по настоящее время;
– проведения микропереписи населения 1994 г.;
– создания подвыборки в целях обследований бюджетов домашних хозяйств, проводимых по территориальному принципу с 1996 г. по
настоящее время;
– проведения других статистических обследований населения.
К сожалению, материалы сплошных переписей населения имеют
определенный вид, который без дополнительной подготовки не может
быть использован в качестве основы выборки. Предварительно на этапе
планирования и подготовки проведения выборочного обследования эту
информацию необходимо подготовить, упорядочить и только потом использовать как основу выборки. Для этих целей основа выборки формируется в виде электронной таблицы. После итогов переписи населения
2002 г. Росстатом впервые была сформирована такая выборка и получила
название Первичный информационный фонд (ПИФ), в котором за основу
выборки был взят счетный участок, он же явился и единицей отбора.
В ПИФ содержалась вся необходимая информация по главным вопросам
49
49

переписи населения: возраст индивидуума, пол, национальность, образование, основной источник дохода, размер или тип жилого помещения.
Первичный информационный фонд имел структуру, позволяющую выделить территории РФ, т. е. был представлен каждый субъект с разграничением административных территорий (районов), внутри которых можно
увидеть отдельно городское и отдельно сельское население.
Наиболее ответственной процедурой является процесс отбора счетных участков из основы выборки. Каким образом произойдет формирование территориальной выборочной сети многоцелевого назначения?
В соответствии с принятым порядком выполнения этой операции
отбор производится способом систематического (механического) отбора по принципу «серпантина». Принцип «серпантина» заключается
в том, что территориальные единицы (районы) в электронной таблице
основы выборки расположены в строгой последовательности географического их расположения с севера на юг в направлении с запада на восток и с востока на запад. При этом каждый следующий район должен
иметь общую границу с предыдущим районом. Объем выборки счетных
участков должен соответствовать принятым ранее методическим решениям по этому вопросу.
Если в соответствии с перечисленными требованиями установлена доля отбора 20 % от общего числа счетных участков в генеральной
совокупности, то это составило, по данным последней переписи населения, 74,3 тыс. счетных участков, в том числе 49,3 тыс. по городскому
населению и 25,0 тыс. по сельскому. Каждый из этих выборочных массивов должен составлять 20 % от соответствующего массива в составе
генеральной совокупности. Вся процедура такого отбора счетных
участков из стратифицированной основы выборки осуществляется по
схеме одноступенчатой механической выборки, формируемой в централизованном порядке с применением информационно-коммуникационных технологий. При проведении механического (систематического)
отбора счетных участков соблюдаются следующие правила:
– например, при 20 % выборке (шаг отбора – 5) если из первых
пяти единиц в случайном порядке была отобрана четвертая единица, то
последующие единицы выборочной совокупности будут иметь в основе
выборки порядковые номера: 9, 14, 19, 24, 29 и т. д.;
– отбор единиц осуществляется автоматически с использованием
соответствующего программного обеспечения, благодаря чему достигаются высокая точность и скорость выполнения данной операции;
50
50
Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]
