Добавил:
ivanov666
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз:
Предмет:
Файл:Методы выборочного обследования. Учебное пособие
.pdf
зался 14 лет. При этом он был отцом двух детей, имел высшее образование, работал начальником смены на крупном нефтехимическом предприятии республики. Вероятно, переписчик по ошибке вместо
числа 41 написал 14.
Материалы переписи населения, в особенности ключевые показатели, подвергаются тщательному контролю, прежде чем будут получены итоговые значения. С учетом ценности такой информации, как
возраст, в переписных листах существует двойная система записи, т. е.,
кроме вопроса «Сколько вам лет?», есть еще и вопрос «Год вашего рождения?». Сопоставление ответов на эти два вопроса позволяет выявить
ошибку и внести нужные корректировки.
При проведении последней переписи населения в 2021 г. такой вид
ошибки был вообще исключен. При указании интервьюером года рождения респондента электронный носитель (планшет) самостоятельно
просчитывал и проставлял количество полных лет в базу данных.
Причины возникновения ошибок регистрации разнообразны, но
один факт остается бесспорным: чем меньше объем заполняемой и обрабатываемой информации, тем меньше встречается ошибок. При
сплошном обследовании, когда количество отчетов достигает десятки
тысяч, распространенность ошибок более вероятна, чем если бы отчетов было в пять, десять раз меньше. Такой объем легче поддается контролю и корректировкам, чем при сплошном обследовании.
Ошибки регистрации также могут носить случайный или систематический характер. Первые представляют меньшую опасность, так как
они могут носить разнонаправленный характер и погашаться при получении итогов. Например, по показателю «Выручка от реализации» в одном отчете ошибка произошла в сторону увеличения, в другом отчете –
в сторону уменьшения, и они частично могут погасить друг друга. Гораздо опаснее возникновение ошибок, которые носят систематический
характер. Они имеют накопительный эффект и могут влиять на формирование итоговых показателей. Например, если бухгалтер сознательно
ежеквартально или ежегодно занижает показатель «Выручка от реализации» с целью сокрытия дохода и уклонения от налогов.
С целью выявления искажений в статистической отчетности
в первую очередь необходимо провести сверку с данными бухгалтерского баланса предприятия, финансовой и банковской отчетностью,
представляемой в налоговые органы. Подобного рода искажения становятся объектом внимания контрольно-ревизионных органов, которые
в соответствии с Кодексом административных правонарушений
31

(КоАП) выносят взыскание исполнителям и руководителям организаций и предприятий.
Таким образом, ошибки регистрации и ошибки репрезентативности имеют разные корни. Ошибки репрезентативности могут встречаться только при проведении выборочного обследования, ошибки регистрации – при любом виде обследования.
Работа над восстановлением ошибок, неответов и непредставления отчетов является объектом специального направления в статистике,
которое сосредоточено на методологических вопросах восстановления
отсутствующих и корректировки ошибочных сведений в вопросниках.
Это направление носит название метод импутации.
Электронные технологии, используемые при обработке первичных статистических данных, предусматривают обязательную корректировку обнаруженных ошибок. Это может быть не только арифметический или логический контроль, но и восстановление пропущенных
и ошибочных данных.
Метод импутации включает в себя несколько простых и сложных
приемов, которые дают возможность вместо ошибочных или пустых
полей в отчете вставить новые значения. Эти значения должны быть
логичны, соответствовать правилам редактирования. Для этого используются математические расчеты, строятся экономико-математические
модели, которые позволяют сделать определенные предположения об
отсутствующей информации. Самыми распространенными методами
импутации являются: методы донора, методы оценок, детерминистские
методы.
Метод донора состоит в замещении отсутствующей или неправильной записи другими данными путем случайного выбора или выбора «ближайшего соседа».
Случайный выбор донора предполагает случайный выбор записей из
отчетов, входящих в соответствующий класс замещения и используемых
в качестве доноров. Как правило, обычно осуществляется в некоторых
специально определенных группах. Эти группы представляют собой достаточно однородные по заданным параметрам типа наблюдений.
В качестве критериев отнесения записей с неответами респондентов к классам импутации целесообразно применять некоторые дополнительные данные, имеющиеся по каждому объекту наблюдения. Это
могут быть отрасли экономики, виды деятельности, географические
районы или города, сельская и городская местность, пол индивида
32
32

и другие данные, методы. Если в записи-реципиенте1 подлежат импутации несколько значений или разделов, то целесообразно взять эти
данные из одной выбранной единицы-донора.
На рис. 3 представлены методы импутации, используемые в статистике, и их инструменты.
Рис. 3. Классификация методов импутации
Импутация методом «ближайшего соседа» предполагает выбор
такой записи из числа донорских, которая ближе всего расположена от
импутируемой записи. В качестве критерия для определения расстояния могут выбираться различные параметры или значения, которые
учитывают отдельные очевидные или традиционные сведения о взаимосвязанности отдельных значений.
1
Реципиент (лат. recipiens — получающий) – в данном случае речь идет об отчете респондента, который
необходимо откорректировать за счет данных другого, аналогичного по содержанию отчета.
33
33

Метод оценок состоит в том, что расчеты недостающего звена показателей осуществляются на базе материалов того же или предыдущего обследования с использованием расчетных средних величин,
трендовых значений, а также показателей регрессии и др.
Детерминистские методы – это более сложная процедура редактирования недостающих данных. В этом случае для осуществления редактирования и импутации используются сложный математический аппарат, требующий специальных знаний и навыков и универсального
программного обеспечения.
Исключительно актуальной является проблема методологического обеспечения обследований, при проведении которых имеют место так называемые неответы, т. е. когда не удается осуществить запланированный сбор информации в полном объеме. Если участие в обследовании является добровольным, как, например, при переписи населения, отдельные лица могут отказаться предоставить информацию
о себе. Некоторые намеченные к обследованию объекты окажутся недоступными для переписчиков, например, в случае болезни. Может возникнуть ситуация, когда отдельные вопросы программы наблюдения
частично останутся без ответа:
– либо из-за нежелания некоторых респондентов отвечать;
– либо из-за отсутствия у них необходимой информации.
Следует различать отсутствие ответов на отдельные вопросы программы и полное выпадение из обследования единиц выборочной совокупности.
Если отсутствует информация по отдельным пунктам вопросника, то
восстановление осуществляется методами редактирования и импутации.
Если попавшая в выборку единица обследования не отчиталась вообще, то
в таком случае могут приниматься следующие варианты решений:
– заменить выпавшие из обследования единицы наблюдения другими единицами, при этом за основу берется какой-либо единый принцип замены;
– произвести операцию «досчета», т. е. осуществить исправление
итоговых данных доступным способом. При этом сохраняется без изменения полученная информация всего массива данных по выборке.
Вопросы неответов в проведении несплошных наблюдений – это
весьма актуальная тема не только для российских статистиков, но и для
статистиков всего мира. Поэтому работе над совершенствованием методологии корректировки неответов уделяется большое внимание как
в зарубежной, так и отечественной статистике. В последние 30–40 лет
это направление развивается особенно активно.
34
34

Говоря об эффективности несплошного наблюдения, необходимо
помнить, что она определяется степенью его методологического сопровождения, т. е. насколько профессионально подготовлен весь комплекс
вопросов планирования обследования, сбора информации и обработки
полученных статистических данных.
На этапе планирования определяются вид несплошного наблюдения, его границы во времени и в пространстве, объем выборочной совокупности, формируются программа регистрации данных и программа
разработки итогов обследования. Если планируется использование
наиболее совершенного вида несплошного наблюдения – выборочного,
то возникает ответственная операция по его математическому обеспечению. Теория выборочного метода является областью математической
статистики, основанной на таких понятиях теории вероятностей, как
случайное событие, случайная величина.
Мы не будем останавливаться на математических аспектах выборочного обследования, а рассмотрим данный вопрос с точки зрения экономической и социальной статистики, его организации, проведения,
а также получения результатов и их использования.
К о н т р о л ь н ы е в о п р о с ы
1. Слабые стороны несплошного обследования.
2. Из-за чего возникают ошибки регистрации?
3. При каком виде наблюдений возникают ошибки регистрации?
4. Какой характер носят ошибки регистрации?
5. Что называется случайными ошибками регистрации?
6. Приведите пример случайных ошибок регистрации.
7. В силу каких причин возникают систематические ошибки реги-
страции?
8. В каких случаях наблюдения (сплошного, несплошного) чаще
всего возникают ошибки регистрации?
9. Как называется направление восстановления отсутствующих
сведений в сводных материалах наблюдения?
10. Как вы понимаете определение импутации?
11. Какие методы импутации вы знаете?
12. Как вы понимаете метод донора?
35
35

13. Как вы понимаете метод «ближайшего соседа»?
14. Как Вы понимаете метод оценки?
15. Чем отличаются ошибки регистрации от ошибок репрезента-
тивности?
16. К чему приводит применение упрощенных способов формиро-
вания обследуемой части генеральной совокупности?
17. Что необходимо предпринять, чтобы уменьшить ошибки ре-
презентативности?
18. Как должны поступить разработчики наблюдения, если в ито-
гах несплошного наблюдения имеются случаи неответов?
19. В каких случаях можно использовать метод редактирования?
20. Как должны поступить разработчики наблюдения в случае не-
желания респондента отвечать на вопросник?
21. Чем определяется эффективность несплошного наблюдения?
В и д ы н е с п л о ш н ы х н а б л ю д е н и й
Как уже было отмечено, несплошным считается любое наблюдение, при котором сбор информации производится только по части генеральной совокупности. Полученные результаты обычно рассматриваются как более или менее точная оценка характеристик генеральной совокупности. Степень приближения данных несплошного наблюдения
к соответствующим показателям генеральной совокупности может колебаться в очень большом диапазоне.
Для различных видов социально-экономических исследований существуют свои критерии точности статистической информации. Большая ответственность лежит на лицах, проектирующих наблюдение
и реализующих проект. Требуются творческий подход, глубокие научные знания и практический опыт, чтобы из множества возможных методических решений выбрать то, которое является оптимальным
с точки зрения целей и условий проведения конкретного обследования.
Прежде всего необходимо иметь четкое представление об особенностях
каждого вида несплошного наблюдения, о его преимуществах и недостатках.
36
36

Существует ряд общих требований, предъявляемых к результатам
статистических исследований. Немецкий статистик Г. Шварц еще
в 1970-е годы сформулировал четыре таких требования:
1) результаты наблюдения каждой обследуемой единицы должны
быть достоверны. Это значит, что они должны точно отражать свойства
этих единиц;
2) наблюдения должны проводиться в такие сроки, чтобы полученная информация не успела устареть;
3) затраты на проведение исследования должны находиться в приемлемом отношении к ценности полученной информации;
4) людские и материальные ресурсы для проведения исследования
должны соответствовать трудности исследования.
Возникает вопрос: при каком виде обследования – сплошном или
несплошном – можно обеспечить более строгое соблюдение этих требований?
Если проводится сплошное наблюдение совокупности значительного объема, то требуется привлечение большого числа сотрудников
(о чем упоминалось в главе «Несплошные наблюдения в современной
статистике»). Невозможно так подобрать людей, чтобы все они имели
достаточно высокую квалификацию. Возникнут трудности с их обучением. Неизбежным результатом недостаточной квалификации персонала будет значительное число ошибок регистрации. Чтобы оценить характер и количество ошибок регистрации, потребуется проведение контроля формуляров наблюдения и повторного частичного обследования.
Очевидно, что при несплошном наблюдении данные по каждой
единице наблюдения за счет сокращения ошибок регистрации будут более достоверными, чем при сплошном обследовании (что соответствует
п.1 требований).
Несплошное наблюдение, благодаря меньшему объему работ,
можно провести в более краткие сроки, чем сплошное. Следовательно,
меньше риск того, что полученная информация окажется устаревшей
(что соответствует п. 2 требований).
При несплошном наблюдении имеет место экономия затрат, поэтому легче соблюсти требование о соответствии затрат уровню ценности получаемой информации (что соответствует п. 3 требований).
Выходит, что, пункты 1–3 легче соблюдать, если проводить несплошное обследование.
Однако, невзирая на несомненные достоинства несплошного
наблюдения, его не всегда можно применить. Так, например, если мы
37
37

хотим получить на выходе итогов обследования данные в детальном
территориальном разрезе, включая уровень отдельных населенных
пунктов, для этого необходимо обеспечить полный охват обследованием всех единиц генеральной совокупности, как в случае с проведением всеобщей переписи населения. Сплошное наблюдение требуется
и в тех случаях, когда на основании полученных итогов принимаются
ответственные решения, выраженные в количественных параметрах
(например, начисление налогов), или формируются итоговые финансовые документы (например, платежный баланс страны, государственный
бюджет).
Если признано целесообразным для исследования какой-либо проблемы проведение несплошного обследования, то существенное значение имеет вопрос о том, какому виду несплошного наблюдения надо
отдать предпочтение, чтобы результаты обследования не обесценились
из-за большой ошибки репрезентативности.
Отдельные виды несплошного наблюдения различаются способами формирования обследуемой части, величиной ошибки репрезентативности, возможностью исследователя регулировать процесс отбора
единиц, включаемых в обследование, величиной затрат времени, труда
и материальных ресурсов на проведение обследования.
Имеются следующие основные виды несплошного наблюдения:
– монографическое обследование;
– анкетное обследование;
– квотный отбор;
– типический отбор;
– цензовый отбор (метод основного массива);
– направленный отбор;
– выборочный метод.
Эти базовые виды наблюдения могут в разных сочетаниях комбинироваться, образуя более сложные способы построения схемы обследования.
Монографическое обследование обычно осуществляют, когда хотят изучить отдельные, но типичные явления объектов, например отдельных предприятий.
Как правило, в монографическом обследовании охватывается несколько единиц или групп из генеральной совокупности, которые затем
детально изучаются. Обычно монографический метод применяется
в целях апробации предстоящего проекта статистического наблюдения,
38
38

которая включает в себя проверку разработанной вновь методики. Отрабатывается процесс организации обследования, проверяется работоспособность программы наблюдения (статистический бланк обследования), отслеживаются недостатки в подготовке и организации процесса
проведения обследования. Все выявленные ошибки, замечания, проблемы должны быть учтены, внесены необходимые корректировки
с целью улучшения процесса предстоящего обследования или переписи. Необходимо помнить, что полученные при монографическом обследовании материалы не могут быть представительными для всей генеральной совокупности. Монографическим обследованием является,
например, пробная перепись населения, которая всегда проводится перед общей переписью населения.
Анкетное обследование – это такой сбор информации, когда вопросники рассылаются отдельным лицам или публикуются в печати
либо в интернете или интервьюеры опрашивают случайных прохожих
на улицах города. Такое обследование предполагает, что участие единиц наблюдения формируется самопроизвольно, по желанию самих обследуемых. В силу этого появляются некоторые особенности, которые
характерны только для этого вида обследования, а именно:
– интервьюер не может оказывать влияния на формирование объема выборки и его состава;
– формируется систематическая ошибка, которая выражается
в смещении структуры совокупности. Смещение может быть, как
в негативную сторону, так и в позитивную;
– процент охвата такого обследования невелик. Практика показывает, что не более 30 % респондентов идут на контакт;
– результаты используются социологами для изучения общественного мнения населения или в торговле для изучения спроса населения
или предметов потребления и т. п.
Квотный отбор представляет собой улучшенную модель анкетного отбора.
С этой целью генеральная совокупность подразделяется на ряд
групп (слоев, типов, квот), которые представляют собой непересекающиеся группы отдельных единиц генеральной совокупности. Это могут
быть жители одного подъезда дома, если мы хотим обследовать данный
дом, или рабочие одного цеха, если есть необходимость обследовать
рабочих одного завода. Задача исследователя заключается в том, чтобы
распределить намеченное к обследованию число единиц по группам
39
39

с точки зрения исследуемой проблемы. От этого будет зависеть доля
Возрастные
группы, лет
Структура
населения, %
Результаты
распределения, чел.
1 2 3 = гр. 2 х 5000
До 70 5 250
60
10
500
50
10
500
40
30
1500
30
30
1500
20
15
750
Итого
100 %
5000 чел.
каждой группы в обследуемой совокупности.
Допустим, что необходимо опросить 5000 индивидуумов. Намеченное к обследованию число единиц (5000) необходимо распределить
по группам (квотам). При этом возможны два способа.
В первом случае лица, подлежащие обследованию, распределяются на группы (квоты) строго по структуре генеральной совокупности. Далее отбор единиц для каждой квоты осуществляется в произвольном порядке, как при анкетном обследовании (либо по волеизъявлению желающих принять участие в обследовании, либо единицы
отбираются по усмотрению переписчика). Полученные при таком обследовании материалы являются достаточно представительными для
генеральной совокупности по тем признакам, на основе которых формировались группы. Иные параметры могут иметь значительное смещение оценок. Чем меньше взаимосвязь признаков, тем большим может оказаться смещение.
Пример формирования квот по структуре генеральной совокупности представлен в табл. 2.
Формирование групп (квот), подлежащих обследованию,
по структуре генеральной совокупности
Таблица 2
Менее популярный способ формирования групп – второй способ.
При этом подлежащее обследованию число единиц распределяется в равных пропорциях между выделенными группами. Бесспорно, что главным
достоинством такого способа является возможность изучения единиц, которые представлены малым количеством. Их число при распределении по
действующей структуре квот было бы недостаточным для получения
40
40
Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]
