Добавил:
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз: Предмет: Файл:

Методы выборочного обследования. Учебное пособие

.pdf
Скачиваний:
0
Добавлен:
07.09.2026
Размер:
2 Мб
Скачать
☆
зался 14 лет. При этом он был отцом двух детей, имел высшее образо­вание, работал начальником смены на крупном нефтехимическом пред­приятии республики. Вероятно, переписчик по ошибке вместо числа 41 написал 14.
Материалы переписи населения, в особенности ключевые показа­тели, подвергаются тщательному контролю, прежде чем будут полу­чены итоговые значения. С учетом ценности такой информации, как возраст, в переписных листах существует двойная система записи, т. е., кроме вопроса «Сколько вам лет?», есть еще и вопрос «Год вашего рож­дения?». Сопоставление ответов на эти два вопроса позволяет выявить ошибку и внести нужные корректировки.
При проведении последней переписи населения в 2021 г. такой вид ошибки был вообще исключен. При указании интервьюером года рож­дения респондента электронный носитель (планшет) самостоятельно просчитывал и проставлял количество полных лет в базу данных.
Причины возникновения ошибок регистрации разнообразны, но один факт остается бесспорным: чем меньше объем заполняемой и об­рабатываемой информации, тем меньше встречается ошибок. При сплошном обследовании, когда количество отчетов достигает десятки тысяч, распространенность ошибок более вероятна, чем если бы отче­тов было в пять, десять раз меньше. Такой объем легче поддается кон­тролю и корректировкам, чем при сплошном обследовании.
Ошибки регистрации также могут носить случайный или система­тический характер. Первые представляют меньшую опасность, так как они могут носить разнонаправленный характер и погашаться при полу­чении итогов. Например, по показателю «Выручка от реализации» в од­ном отчете ошибка произошла в сторону увеличения, в другом отчете – в сторону уменьшения, и они частично могут погасить друг друга. Го­раздо опаснее возникновение ошибок, которые носят систематический характер. Они имеют накопительный эффект и могут влиять на форми­рование итоговых показателей. Например, если бухгалтер сознательно ежеквартально или ежегодно занижает показатель «Выручка от реали­зации» с целью сокрытия дохода и уклонения от налогов.
С целью выявления искажений в статистической отчетности в первую очередь необходимо провести сверку с данными бухгалтер­ского баланса предприятия, финансовой и банковской отчетностью, представляемой в налоговые органы. Подобного рода искажения стано­вятся объектом внимания контрольно-ревизионных органов, которые в соответствии с Кодексом административных правонарушений
31
(КоАП) выносят взыскание исполнителям и руководителям организа­ций и предприятий.
Таким образом, ошибки регистрации и ошибки репрезентативно­сти имеют разные корни. Ошибки репрезентативности могут встре­чаться только при проведении выборочного обследования, ошибки ре­гистрации – при любом виде обследования.
Работа над восстановлением ошибок, неответов и непредставле­ния отчетов является объектом специального направления в статистике, которое сосредоточено на методологических вопросах восстановления отсутствующих и корректировки ошибочных сведений в вопросниках. Это направление носит название метод импутации.
Электронные технологии, используемые при обработке первич­ных статистических данных, предусматривают обязательную корректи­ровку обнаруженных ошибок. Это может быть не только арифметиче­ский или логический контроль, но и восстановление пропущенных и ошибочных данных.
Метод импутации включает в себя несколько простых и сложных приемов, которые дают возможность вместо ошибочных или пустых полей в отчете вставить новые значения. Эти значения должны быть логичны, соответствовать правилам редактирования. Для этого исполь­зуются математические расчеты, строятся экономико-математические модели, которые позволяют сделать определенные предположения об отсутствующей информации. Самыми распространенными методами импутации являются: методы донора, методы оценок, детерминистские методы.
Метод донора состоит в замещении отсутствующей или непра­вильной записи другими данными путем случайного выбора или вы­бора «ближайшего соседа».
Случайный выбор донора предполагает случайный выбор записей из отчетов, входящих в соответствующий класс замещения и используемых в качестве доноров. Как правило, обычно осуществляется в некоторых специально определенных группах. Эти группы представляют собой до­статочно однородные по заданным параметрам типа наблюдений.
В качестве критериев отнесения записей с неответами респонден­тов к классам импутации целесообразно применять некоторые допол­нительные данные, имеющиеся по каждому объекту наблюдения. Это могут быть отрасли экономики, виды деятельности, географические районы или города, сельская и городская местность, пол индивида
32
32
и другие данные, методы. Если в записи-реципиенте1 подлежат импу­тации несколько значений или разделов, то целесообразно взять эти данные из одной выбранной единицы-донора.
На рис. 3 представлены методы импутации, используемые в ста­тистике, и их инструменты.
Рис. 3. Классификация методов импутации
Импутация методом «ближайшего соседа» предполагает выбор
такой записи из числа донорских, которая ближе всего расположена от импутируемой записи. В качестве критерия для определения расстоя­ния могут выбираться различные параметры или значения, которые учитывают отдельные очевидные или традиционные сведения о взаи­мосвязанности отдельных значений.
1
Реципиент (лат. recipiens — получающий) – в данном случае речь идет об отчете респондента, который
необходимо откорректировать за счет данных другого, аналогичного по содержанию отчета.
33
33
Метод оценок состоит в том, что расчеты недостающего звена по­казателей осуществляются на базе материалов того же или предыду­щего обследования с использованием расчетных средних величин, трендовых значений, а также показателей регрессии и др.
Детерминистские методы – это более сложная процедура редак­тирования недостающих данных. В этом случае для осуществления ре­дактирования и импутации используются сложный математический ап­парат, требующий специальных знаний и навыков и универсального программного обеспечения.
Исключительно актуальной является проблема методологиче­ского обеспечения обследований, при проведении которых имеют ме­сто так называемые неответы, т. е. когда не удается осуществить запла­нированный сбор информации в полном объеме. Если участие в обсле­довании является добровольным, как, например, при переписи населе­ния, отдельные лица могут отказаться предоставить информацию о себе. Некоторые намеченные к обследованию объекты окажутся не­доступными для переписчиков, например, в случае болезни. Может воз­никнуть ситуация, когда отдельные вопросы программы наблюдения частично останутся без ответа:
– либо из-за нежелания некоторых респондентов отвечать;
– либо из-за отсутствия у них необходимой информации.
Следует различать отсутствие ответов на отдельные вопросы про­граммы и полное выпадение из обследования единиц выборочной сово­купности.
Если отсутствует информация по отдельным пунктам вопросника, то восстановление осуществляется методами редактирования и импутации. Если попавшая в выборку единица обследования не отчиталась вообще, то в таком случае могут приниматься следующие варианты решений:
– заменить выпавшие из обследования единицы наблюдения дру­гими единицами, при этом за основу берется какой-либо единый прин­цип замены;
– произвести операцию «досчета», т. е. осуществить исправление итоговых данных доступным способом. При этом сохраняется без из­менения полученная информация всего массива данных по выборке.
Вопросы неответов в проведении несплошных наблюдений – это весьма актуальная тема не только для российских статистиков, но и для статистиков всего мира. Поэтому работе над совершенствованием ме­тодологии корректировки неответов уделяется большое внимание как в зарубежной, так и отечественной статистике. В последние 30–40 лет это направление развивается особенно активно.
34
34
Говоря об эффективности несплошного наблюдения, необходимо помнить, что она определяется степенью его методологического сопро­вождения, т. е. насколько профессионально подготовлен весь комплекс вопросов планирования обследования, сбора информации и обработки полученных статистических данных.
На этапе планирования определяются вид несплошного наблюде­ния, его границы во времени и в пространстве, объем выборочной со­вокупности, формируются программа регистрации данных и программа разработки итогов обследования. Если планируется использование наиболее совершенного вида несплошного наблюдения – выборочного, то возникает ответственная операция по его математическому обеспе­чению. Теория выборочного метода является областью математической статистики, основанной на таких понятиях теории вероятностей, как случайное событие, случайная величина.
Мы не будем останавливаться на математических аспектах выбо­рочного обследования, а рассмотрим данный вопрос с точки зрения эко­номической и социальной статистики, его организации, проведения, а также получения результатов и их использования.
К о н т р о л ь н ы е в о п р о с ы
1. Слабые стороны несплошного обследования.
2. Из-за чего возникают ошибки регистрации?
3. При каком виде наблюдений возникают ошибки регистрации?
4. Какой характер носят ошибки регистрации?
5. Что называется случайными ошибками регистрации?
6. Приведите пример случайных ошибок регистрации.
7. В силу каких причин возникают систематические ошибки реги-
страции?
8. В каких случаях наблюдения (сплошного, несплошного) чаще
всего возникают ошибки регистрации?
9. Как называется направление восстановления отсутствующих
сведений в сводных материалах наблюдения?
10. Как вы понимаете определение импутации?
11. Какие методы импутации вы знаете?
12. Как вы понимаете метод донора?
35
35
13. Как вы понимаете метод «ближайшего соседа»?
14. Как Вы понимаете метод оценки?
15. Чем отличаются ошибки регистрации от ошибок репрезента-
тивности?
16. К чему приводит применение упрощенных способов формиро-
вания обследуемой части генеральной совокупности?
17. Что необходимо предпринять, чтобы уменьшить ошибки ре-
презентативности?
18. Как должны поступить разработчики наблюдения, если в ито-
гах несплошного наблюдения имеются случаи неответов?
19. В каких случаях можно использовать метод редактирования?
20. Как должны поступить разработчики наблюдения в случае не-
желания респондента отвечать на вопросник?
21. Чем определяется эффективность несплошного наблюдения?
В и д ы н е с п л о ш н ы х н а б л ю д е н и й
Как уже было отмечено, несплошным считается любое наблюде­ние, при котором сбор информации производится только по части гене­ральной совокупности. Полученные результаты обычно рассматрива­ются как более или менее точная оценка характеристик генеральной со­вокупности. Степень приближения данных несплошного наблюдения к соответствующим показателям генеральной совокупности может ко­лебаться в очень большом диапазоне.
Для различных видов социально-экономических исследований су­ществуют свои критерии точности статистической информации. Боль­шая ответственность лежит на лицах, проектирующих наблюдение и реализующих проект. Требуются творческий подход, глубокие науч­ные знания и практический опыт, чтобы из множества возможных ме­тодических решений выбрать то, которое является оптимальным с точки зрения целей и условий проведения конкретного обследования. Прежде всего необходимо иметь четкое представление об особенностях каждого вида несплошного наблюдения, о его преимуществах и недо­статках.
36
36
Существует ряд общих требований, предъявляемых к результатам статистических исследований. Немецкий статистик Г. Шварц еще в 1970-е годы сформулировал четыре таких требования:
1) результаты наблюдения каждой обследуемой единицы должны быть достоверны. Это значит, что они должны точно отражать свойства этих единиц;
2) наблюдения должны проводиться в такие сроки, чтобы полу­ченная информация не успела устареть;
3) затраты на проведение исследования должны находиться в при­емлемом отношении к ценности полученной информации;
4) людские и материальные ресурсы для проведения исследования должны соответствовать трудности исследования.
Возникает вопрос: при каком виде обследования – сплошном или несплошном – можно обеспечить более строгое соблюдение этих тре­бований?
Если проводится сплошное наблюдение совокупности значитель­ного объема, то требуется привлечение большого числа сотрудников (о чем упоминалось в главе «Несплошные наблюдения в современной статистике»). Невозможно так подобрать людей, чтобы все они имели достаточно высокую квалификацию. Возникнут трудности с их обуче­нием. Неизбежным результатом недостаточной квалификации персо­нала будет значительное число ошибок регистрации. Чтобы оценить ха­рактер и количество ошибок регистрации, потребуется проведение кон­троля формуляров наблюдения и повторного частичного обследования.
Очевидно, что при несплошном наблюдении данные по каждой единице наблюдения за счет сокращения ошибок регистрации будут бо­лее достоверными, чем при сплошном обследовании (что соответствует п.1 требований).
Несплошное наблюдение, благодаря меньшему объему работ, можно провести в более краткие сроки, чем сплошное. Следовательно, меньше риск того, что полученная информация окажется устаревшей (что соответствует п. 2 требований).
При несплошном наблюдении имеет место экономия затрат, по­этому легче соблюсти требование о соответствии затрат уровню ценно­сти получаемой информации (что соответствует п. 3 требований).
Выходит, что, пункты 1–3 легче соблюдать, если проводить не­сплошное обследование.
Однако, невзирая на несомненные достоинства несплошного наблюдения, его не всегда можно применить. Так, например, если мы
37
37
хотим получить на выходе итогов обследования данные в детальном территориальном разрезе, включая уровень отдельных населенных пунктов, для этого необходимо обеспечить полный охват обследова­нием всех единиц генеральной совокупности, как в случае с проведе­нием всеобщей переписи населения. Сплошное наблюдение требуется и в тех случаях, когда на основании полученных итогов принимаются ответственные решения, выраженные в количественных параметрах (например, начисление налогов), или формируются итоговые финансо­вые документы (например, платежный баланс страны, государственный бюджет).
Если признано целесообразным для исследования какой-либо про­блемы проведение несплошного обследования, то существенное значе­ние имеет вопрос о том, какому виду несплошного наблюдения надо отдать предпочтение, чтобы результаты обследования не обесценились из-за большой ошибки репрезентативности.
Отдельные виды несплошного наблюдения различаются спосо­бами формирования обследуемой части, величиной ошибки репрезен­тативности, возможностью исследователя регулировать процесс отбора единиц, включаемых в обследование, величиной затрат времени, труда и материальных ресурсов на проведение обследования.
Имеются следующие основные виды несплошного наблюдения:
– монографическое обследование;
– анкетное обследование;
– квотный отбор;
– типический отбор;
– цензовый отбор (метод основного массива);
– направленный отбор;
– выборочный метод.
Эти базовые виды наблюдения могут в разных сочетаниях комби­нироваться, образуя более сложные способы построения схемы обсле­дования.
Монографическое обследование обычно осуществляют, когда хо­тят изучить отдельные, но типичные явления объектов, например от­дельных предприятий.
Как правило, в монографическом обследовании охватывается не­сколько единиц или групп из генеральной совокупности, которые затем детально изучаются. Обычно монографический метод применяется в целях апробации предстоящего проекта статистического наблюдения,
38
38
которая включает в себя проверку разработанной вновь методики. От­рабатывается процесс организации обследования, проверяется работо­способность программы наблюдения (статистический бланк обследова­ния), отслеживаются недостатки в подготовке и организации процесса проведения обследования. Все выявленные ошибки, замечания, про­блемы должны быть учтены, внесены необходимые корректировки с целью улучшения процесса предстоящего обследования или пере­писи. Необходимо помнить, что полученные при монографическом об­следовании материалы не могут быть представительными для всей ге­неральной совокупности. Монографическим обследованием является, например, пробная перепись населения, которая всегда проводится пе­ред общей переписью населения.
Анкетное обследование – это такой сбор информации, когда во­просники рассылаются отдельным лицам или публикуются в печати либо в интернете или интервьюеры опрашивают случайных прохожих на улицах города. Такое обследование предполагает, что участие еди­ниц наблюдения формируется самопроизвольно, по желанию самих об­следуемых. В силу этого появляются некоторые особенности, которые характерны только для этого вида обследования, а именно:
– интервьюер не может оказывать влияния на формирование объ­ема выборки и его состава;
– формируется систематическая ошибка, которая выражается в смещении структуры совокупности. Смещение может быть, как в негативную сторону, так и в позитивную;
– процент охвата такого обследования невелик. Практика показы­вает, что не более 30 % респондентов идут на контакт;
– результаты используются социологами для изучения обществен­ного мнения населения или в торговле для изучения спроса населения или предметов потребления и т. п.
Квотный отбор представляет собой улучшенную модель анкет­ного отбора.
С этой целью генеральная совокупность подразделяется на ряд групп (слоев, типов, квот), которые представляют собой непересекаю­щиеся группы отдельных единиц генеральной совокупности. Это могут быть жители одного подъезда дома, если мы хотим обследовать данный дом, или рабочие одного цеха, если есть необходимость обследовать рабочих одного завода. Задача исследователя заключается в том, чтобы распределить намеченное к обследованию число единиц по группам
39
39
с точки зрения исследуемой проблемы. От этого будет зависеть доля
Возрастные группы, лет
Структура
населения, %
Результаты
распределения, чел.
1 2 3 = гр. 2 х 5000
До 70 5 250
60
10
500
50
10
500
40
30
1500
30
30
1500
20
15
750
Итого
100 %
5000 чел.
каждой группы в обследуемой совокупности.
Допустим, что необходимо опросить 5000 индивидуумов. Наме­ченное к обследованию число единиц (5000) необходимо распределить по группам (квотам). При этом возможны два способа.
В первом случае лица, подлежащие обследованию, распределя­ются на группы (квоты) строго по структуре генеральной совокупно­сти. Далее отбор единиц для каждой квоты осуществляется в произ­вольном порядке, как при анкетном обследовании (либо по волеизъ­явлению желающих принять участие в обследовании, либо единицы отбираются по усмотрению переписчика). Полученные при таком об­следовании материалы являются достаточно представительными для генеральной совокупности по тем признакам, на основе которых фор­мировались группы. Иные параметры могут иметь значительное сме­щение оценок. Чем меньше взаимосвязь признаков, тем большим мо­жет оказаться смещение.
Пример формирования квот по структуре генеральной совокупно­сти представлен в табл. 2.
Формирование групп (квот), подлежащих обследованию,
по структуре генеральной совокупности
Таблица 2
Менее популярный способ формирования групп – второй способ. При этом подлежащее обследованию число единиц распределяется в рав­ных пропорциях между выделенными группами. Бесспорно, что главным достоинством такого способа является возможность изучения единиц, ко­торые представлены малым количеством. Их число при распределении по действующей структуре квот было бы недостаточным для получения
40
40
Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]