Методы социологического исследования. Учебное пособие
.pdf
Гл а в а 5
КОДИРОВКА И АНАЛИЗ ДАННЫХ В СОЦИОЛОГИЧЕСКОМ ИССЛЕДОВАНИИ
Основные понятия:
Кодировка; перекодировка; обработка открытых вопросов. Интерпретация; упорядочивание данных; обобщение; вычисление
средних; проверка гипотез.
Вторичный анализ; первичное исследование; вторичное исследование; первичные данные.
Отчет по результатам исследования; приложения к отчету; аналитическая записка; представление качественных данных; редактированные тексты; комментированные первичные тексты; аналитический текст.
Качество социологического исследования; контрольный бланк оценки исследования; исследовательская триангуляция; триангуляция данных; методологическая триангуляция.
1.Кодировка данных
иподготовка к обработке
Итак, процедура сбора информации завершена, социолог получил заполненные опросные листы, бланки контент-анализа и т. п. Наступает этап подготовки первичных данных к обработке. Как правило, социолог проверяет правильность заполнения инструментария при его возврате интервьюерами, анкетерами или кодировщиками, выявляет бракованные опросные листы и бланки и исключает их из дальнейшей обработки.
91
При кодировке опросных листов следует обязательно пронумеровать каждый опросный/кодировочный лист. Данная нумерация помогает при исправлении ошибок панчеров (тех, кто занимается забиванием данных в базу) и самих анкетеров/интервьюеров. Также рекомендуется в базе данных указывать фамилии или личные коды анкетеров/интервьюеров для проверки качества их работы.
Следующий шаг — кодировка данных. Кодированием называется «процесс присвоения количественных значений имеющейся у нас информации» (Мангейм Дж. Б., Рич Р. К. Политология. Методы исследования. М.: Издательство «Весь Мир», 1997. С. 356). Частично процесс кодирования осуществляется уже в ходе заполнения опросных листов, когда респондент выбирает тот или иной вариант ответа
иобводит соответствующую ему цифру в опросном листе. Но нередко уже после сбора информации необходимо провести перекодировку некоторых вопросов. Например, в демографической части опросного листа респондента просят ответить, сколько полных лет ему исполнилось на момент опроса. Для анализа данных, предположим, что исследователю лучше иметь информацию о возрастной структуре выборочной совокупности в виде возрастных интервалов. Следовательно, необходимо произвести перекодировку ответов респондентов: присвоить возрасту каждого респондента номер возрастного интервала.
Итак, предположим, что нашу выборочную совокупность целесообразно разбить на следующие возрастные интервалы:
1)18–24 года 2) 25–34 года 3) 35–44 года 4) 45–54 года 5) 55–64 года 6) 65 и старше.
Тогда, против ответа респондента, где он написал, скажем, что ему 56 лет, мы поставим цифру «5» (что означает пятый возрастной интервал). Такую работу следует провести до начала формирования базы данных, так как постоянное переключение внимания от забивания данных к присвоению новых кодов приводит к быстрой утомляемости
ибольшому количеству ошибок.
Иногда требует перекодировки и обработка вопросов в форме семантического дифференциала. Вернемся к примеру, приведенному в разделе 1. «Шкалы» Главы 2:
92
Пример:
Вы являетесь подписчиком нашей интернет-рассылки. Какой из предложенных вариантов является для вас более приемлемым («3» — наиболее приемлемый вариант, «2» — более-менее приемлемый вариант, «1» — не очень приемлемый вариант, «0» — затрудняюсь сделать выбор):
Повышение стоимости рассылки |
|
Увеличение объема рекламных ма- |
||||
при сохранении объема рекламы |
|
териалов при сохранении стоимо- |
||||
|
|
|
|
сти рассылки |
|
|
3 |
2 |
1 |
0 |
1 |
2 |
3 |
С точки зрения математики в левой части шкалы должны стоять отрицательные значения («– 3», «– 2», «– 1»), но в сознании респондента такие значения ассоциируются с чем-то негативным, что может повлиять на его выбор. Кроме того, мы не можем забивать отрицательные значения в базу данных. Следовательно, шкалу целесообразно «сдвинуть» таким образом, чтобы изменить значения для удобства обработки и расчетов:
Вы являетесь подписчиком нашей интернет-рассылки. Какой из предложенных вариантов является для вас более приемлемым («3» — наиболее приемлемый вариант, «2» — более-менее приемлемый вариант, «1» — не очень приемлемый вариант, «0» — затрудняюсь сделать выбор):
Повышение стоимости рассылки |
Увеличение объема рекламных ма- |
|||||
при сохранении объема рекламы |
териалов при сохранении стоимо- |
|||||
|
|
|
сти рассылки |
|
|
|
3 |
2 |
1 |
0 |
1 |
2 |
3 |
1 |
2 |
3 |
4 |
5 |
6 |
7 |
Итак, наша шкала теперь имеет значения от 1 до 7, что позволяет проводить все необходимые расчеты.
При подготовке опросных листов к обработке нужно закодировать (если это возможно) и открытые вопросы. Обработка открытых воп росов обычно представляет собой весьма трудоемкий процесс. Существует ряд компьютерных программ, помогающих такой обработке. Чаще всего обработку открытых вопросов осуществляют вручную,
93
в базе данных обычно лишь подсчитывают общее количество ответов на открытые вопросы. Варианты обработки во многом зависят от того, какие цели ставят исследователи, размещая открытые вопросы в опросном листе.
Если цель — получение развернутых высказываний респондентов, то следует провести предварительную эмпирическую типологизацию таких высказываний. Я обычно предлагаю следующий алгоритм:
1.Выявить и определить количество наиболее типичных (и, в большинстве своем, малосодержательных высказываний). Респонденты часто дают весьма тавтологичные определения. Ниже будет приведен фрагмент отчета по исследованию (исследование «Информационная культура студентов» (2000 и 2001 год) проводилось в рамках социологической практики, руководитель практики доц. Ю. В. Рахманова), содержащий обработку ответов на открытый вопрос.
Пример:
На вопрос «Что вы понимаете под «информатизацией образования»?» ответило 273 человека. Самый распространенный ответ — «привлечение большого количества источников (образование через интернет, внедрение интернета в вузах)» — так ответило 82 человека; «внедрение и использование компьютера в процессе обучения» — 53 человека; на третьем месте вариант ответа — «информация (подача информации, образовательная система должна быть более информированной)» — 46 человек; «повышение уровня обучения» — так ответило 30 человек; «внедрение информационных технологий» — 28 человек; «доступ студентов к компьютерам» — 18 человек, «увеличение числа компьютеров» — 9 человек; «расширение кругозора» — 5 человек; «массовость» — 1 человек; «ничего» — 1 человек.
2.Просмотреть наиболее оригинальные, интересные и спорные высказывания; их целесообразно процитировать в отчете, снабдив необходимыми комментариями.
3.Попытаться оценить «высказывания не по теме»; их имеет смысл также привести в тексте отчета, особенно если исследователь затрудняется с их интерпретацией.
94
Как правило, процент ответов на открытые вопросы меньше, чем в среднем по опросному листу. Следует проанализировать количество ответивших и неответивших, возможно, сделать вывод об уместности размещения данного вопроса, корректности его формулировки или способности респондентов ответить на него.
Далее обработка данных осуществляется с помощью программы SPSS. Основные принципы работы с данной программой представлены в пособии: Рахманова Ю. В. Социологическое исследование:
методология, методика, техника: учебное пособие. СПб.: Изд-во РГПУ им. А. И. Герцена, 2005. Часть 3.
2. Обобщение и представление результатов социологического исследования
В предыдущих главах давалось описание методов сбора и обработки количественных данных, но таблицы, графики, проценты, расчеты дополнительных переменных сами по себе не дают объяснений. Для получения выводов необходимо провести интерпретацию результатов социологического исследования.
Интерпретация — процесс приписывания содержательного смысла полученным в результате применения математического метода формальным символам, выражениям, отношением и т. д. Опираясь на соответствующую теорию, обоснование и объяснительный потенциал которой излагаются в методологическом разделе программы, и полученные в ходе полевого этапа данные, исследователь выделяет обобщающие характеристики объекта, описывает тенденции его развития, осмысливает взаимосвязи между социальными явлениями.
Объект исследования в социальных науках сложен, включает разнородные компоненты и подвергается воздействию со стороны других структур и элементов, поэтому однозначная интерпретация социологических данных затруднительна. Содержательные выводы зависят от теоретической концепции, социологической культуры исследователя, качества собранной информации, примененных методов обработки данных.
95
Можно выделить три вида работ, характерных для этапа интерпретации данных.
1.Упорядочивание, классификация, группировка эмпирических данных в соответствии с исследовательскими задачами. Его результатом являются количественные характеристики изучаемого объекта, явления (вычисление процентов, коэффициентов взаимосвязи и т. п.). Способы группирования осуществляются в соответствии с описательными гипотезами исследования.
2.Обобщение данных, проверка значимости и достоверности числовых характеристик. На этом этапе происходят «сжатие» данных, т. е. выделяются усредненные значения (вычисление средних значений, мер разброса).
3.Проверка с помощью полученных числовых характеристик выдвинутых в исследовании гипотез. Для этого используются такие методы,
как критерий хи-квадрат, дисперсионный анализ, корреляция и т. п.
Подр. см.: Гречихин В. Г. Лекции по методике и технике социологических исследований. М., 1988.
3. Методы вторичного анализа данных
Очень часто социологическое исследование ассоциируется в первую очередь с процедурой сбора данных. И это не противоречит действительности, большинство проводимых исследований связаны со сбором первичной информации, а эта часть работы социолога наиболее заметна и объемна. Но всегда ли стоит собирать данные самому исследователю?
В социологии существует понятие «вторичный анализ данных». Под ним понимается анализ результатов ранее проведенных социологических исследований с другими целями и задачами, нежели те, который ставились при сборе первичных данных. В ходе первичного исследования чаще всего собирается объем информации избыточный для него. Информация содержит больше возможностей и смысла, нежели нужно исследователям для решения поставленных задач. Поэтому вполне уместна последующая работа с данными, т. е. проведение вторичного анализа.
96
Некоторые исследователи разделяют понятия «вторичный анализ» и «вторичное исследование». Вторичный анализ предполагает, что методологические, целевые установки исходного исследования сохраняются. Во вторичном исследовании происходит изменение концептуального подхода, выдвижение новых целей, задач, гипотез, создается программа социологического исследования. Общим основанием для вторичного анализа и вторичного исследования является исходный массив эмпирических данных.
Вторичный анализ позволяет:
–сопоставлять результаты исследований, посвященных определенному предмету изучения, на разных выборках с целью выявления специфики происходящих социальных процессов в разных социальных группах, проводить сравнения в рамках кросс-культульных исследований;
–объединять данные, собранные на разных территориальных и социальных общностях, для выявления характеристик, присущих более крупным общностям;
–осуществлять мониторинговые исследования для изучения временной динамики социальных процессов;
–проводить методические исследования, связанные со сравнением эффективности разных методов сбора, обработки и анализа данных, формирования выборочных совокупностей;
–использовать как источник информации о распределения признаков в совокупности при расчете выборки для проведения
первичных социологических исследований.
Информация о полученных в ходе первичных исследований данных представляется либо в уже опубликованном виде как отчеты по результатам исследований, либо хранится и предоставляется в виде первичных данных в социологических архивах.
В нашей стране функционирует Единый архив социологических данных Независимого института социальной политики. Как специальная программа в рамках Независимого института социальной политики Единый архив социологических данных работает с 2002 года. В архив депонировали результаты своих исследований такие организации, как Левада-Центр, Всероссийский центр изучения общественного мнения (ВЦИОМ), Институт социологии РАН, Фонд «Общественное мнение» (ФОМ), Институт комплексных социальных
97
исследований РАН, РОМИР, Московский центр Карнеги, Институт социально-экономических проблем народонаселения РАН, Центр гуманитарных и политических исследований «Стратегия», Институт философии РАН (http://www.socpol.ru/archives/about_proj.shtml). С 2010 года архив был перемещен в НИУ ВШЭ и сейчас находится по адресу: http://sophist.hse.ru/.
Уникальным архивом эмпирических данных располагает Институт социологии РАН. Архив содержит результаты более чем 700 социологических исследований, проведенных и Институтом социологии РАН, и другими социологическими центрами страны. Особенность данных этого архива в том, что они охватывают большой период времени. Первое исследование, данные по которому есть в архиве, 1966 года. Адрес банка социологических данных Института социологии РАН — http://www.isras.ru/Databank.html.
Архивы выполняют не только функции аккумулирования данных, но ведут активную методическую, исследовательскую и образовательную работу по обеспечению качества социологической информации.
Отсутствие необходимости собирать первичные данные создает иллюзию о значительном упрощении работы, особенно когда массивов данных по интересующей исследователя проблеме достаточно. Но из этих массивов уже подвергавшихся анализу необходимо добыть новые сведения. Как этого добиться? Во-первых, проработать методологический раздел программы исследования, определив цели, задачи, операционализировав понятия, выдвинув гипотезы, т. е. разработать программу как при первичном социологическом исследовании, а уже после этого использовать данные тех исследований, которые имеют операционализации переменных соответствующих гипотезам, которые подлежат проверке. Во-вторых, отобранные данные должны быть получены на выборочной совокупности адекватной поставленным задачам. Например, если необходимо оценить мнение студенческой молодежи России по какой-то проблеме, использование для этих целей массивов, полученных по результатам опроса студентов Санкт-Петербурга и Москвы, не позволит решить поставленные исследователем задачи.
Опираясь на первичные данные и желая на их основе получить значимые результаты, исследователь вынужден критичнее относиться к доступному эмпирическому материалу. Здесь разница между пер-
98
вичным и вторичным исследованием стирается, так как результат работы определяется качеством исследования (об оценке качества исследования, как первичного, так и вторичного, — см.: Раздел 5. «Качество социологического исследования»). Следует заметить, что вторичный анализ в силу своих особенностей четче указывает на погрешности, допущенные в ходе первичного исследования.
Подробнее о вторичном анализе данных см.:
Рахманова Ю. В., Яшина М. Н. Глава 27. Основные методы сбора социальной информации / Социология: учебник для вузов / под ред. А. В. Воронцова. М.: Дрофа, 2011. С. 495–499.
Яшина М. Н. Глава 16. Вторичный анализ данных / Методология и методы социологического исследования: учебник / под ред. В. И. Дудиной, Е. Э. Смирновой; С.-Петерб. гос. ун-т. СПб.: Изд-во СПбГУ, 2014. С. 362–374.
4. Отчет по результатам социологического исследования
Результаты социологического исследования представляются в виде отчета и/или публикаций. Научить писать отчет по результатам исследования практически невозможно. Поэтому в данном разделе лишь будут приведены основные принципы написания отчета и самые общие рекомендации. Большинство начинающих социологов структуру отчета копируют со структуры опросного листа (или другого инструментария — в зависимости от выбранного метода сбора информации). Такой отчет принимает вид «анкеты с комментариями». Понятно, что такая форма становится невозможной при использовании нескольких методов сбора информации, но и в случае одного метода лучше придерживаться другой структуры отчета.
Оптимальной моделью является отчет, содержащий следующие разделы:
1.Описание объекта и предмета исследования, указание выборочной совокупности (теоретически рассчитанной и реально опрошенной).
99
2.Информация о ходе исследования: трудности, необходимые изменения в программе в процессе ее реализации и т. п. (здесь целесообразно ссылаться на программу социологического исследования, которая обычно включается в Приложения к отчету).
3.Разделы, отражающие гипотезы, сформулированные в программе исследования. Принцип формирования разделов таков: одна гипотеза — один раздел.
4.Выводы и рекомендации.
5.Приложения к отчету. Сюда включаются: программа социологического исследования; инструментарий; необходимые статистические данные, результаты обработки первичной информации в виде таблиц, диаграмм и т. п. (последние необходимы для того, чтобы не перегружать текст отчета цифровой информа-
цией, приводя в отчете лишь основные цифры и давая ссылки на соответствующие Приложения).
Каждый раздел отчета должен завершаться краткими выводами. Если сам отчет достаточно объемен, целесообразно составить аналитическую записку, содержащую основные идеи и выводы отчета, а также ссылки на те разделы отчета, где эти выводы подкреплены цифрами, логическими обоснованиями.
В отчете следует четко разделять результаты исследования, их интерпретацию исследователем и его рекомендации. Целесообразно сделать это различие наглядным: используя в тексте отчета различные шрифты для отражения результатов и выводов, на них основанных, и/или разнести их в тексте: сначала результаты, затем их интерпретация и рекомендации. Последний способ не всегда уместен, так как делает отчет трудным для прочтения неспециалистами; кроме того, такое разделение результатов и их интерпретации затрудняет оценку читателем логичности полученных выводов из данных исследования.
Специфика представления качественных данных
Отчет по результатам качественного исследования имеет свою специфику. Описывая результаты такого исследования, автор ориентируется на аудиторию, на которую рассчитан текст, и на задачи, поставленные в исследовании. В зависимости от этого отчет может быть представлен в нескольких формах.
100
