
- •Глава 1. Информация, обрабатываемая статистическим пакетом
- •1.1. Анкетные данные
- •1.2. Типы переменных
- •1.3. Имена переменных и метки, коды неопределенных значений
- •Глава 2. Статистический пакет для социологических исследований. Общее описпние и поодготовка данных
- •2.1. Структура пакета
- •2.2. Схема организации данных, окна spss
- •2.3. Управление работой пакета
- •2.4. Режим диалога и командный режим
- •Глава 2. Статистический пакет для социологических исследований. Общее описпние и поодготовка данных
- •2.1. Структура пакета
- •2.2. Схема организации данных, окна spss
- •2.3. Управление работой пакета
- •2.4. Режим диалога и командный режим
- •Variable labels rangv14 "ранг по доходам"/
- •V14_5 "квинтильные группы по доходам"/
- •Variable labels oppos 'Степень противостояния ссср и Японии'
- •Value labels oppos 1 'Взаимное' 2 'Одна из сторон' 3 'Нет противостояния'.
- •2.5. Операции с файлами Агрегирование данных (команда aggregate)
- •Функции агрегирования
- •Глава 3. Процедуры получения описательных статистик и таблиц сопряженности
- •3.1. Команды описания распределений
- •3.2 Анализ связи между неколичественными переменными. Crosstabs - таблицы сопряженности
- •Var lab w4 "Возможность удовлетворить территориториальные требования Японии".
- •Val lab w4 1 "отдать" 2 "не надо" "не знаю".
- •Cells статистики смещения частот
- •Statistics - исследование связи неколичественных перемееных
- •Измерение силы связи между номинальными переменными
- •Статистический эксперимент для оценки значимости и ее прямое вычисление
- •3.3. Сложные табличные отчеты. Таблицы для неальтернативных вопросов
- •ТипичнЫe примеРы использования Multiple Response Tables
- •Var lab m1 "Зап Сиб" m2 "Вост Сиб" m3 "Дальн Вост".
- •Var lab d1 'Жесткий вариант'
- •3.4. Множественные сравнения в таблицах для неальтернативных вопросов. Программа Typology Tables
- •Глава 4. Сравнение средних, корреляции
- •4.3. Compare Means - простые параметрические методы сравнения средних.
- •Variable labels lnv14m "логарифм промедианного дохода".
- •Var lab w10 "образование".
- •Value lab w10 1 "Высшее" 2 "н/высш" 3 "ср. Спец" 4 "среднее" 5 "ниже среднего".
- •4.4. Корреляции (correlations)
- •Глава 5. Непараметрические тесты. Команда Nonparametric tests.
- •5.1. Одновыборочные тесты
- •Var lab w4 "отношение к передаче островов".
- •Val lab 1 "Отдать" 2 "нет".
- •5.3. Тесты для ранговых переменных
- •5.4. Тесты для связанных выборок (related samples)
5.3. Тесты для ранговых переменных
В ряде методов по имеющимся числовым значениям исследуемой переменной объектам приписываются ранги. Для вычисления рангов объекты упорядочиваются от минимального значения переменной к максимальному, и порядковые номера объектов считаются рангами. Если для некоторых объектов числовые значения переменной повторяются, то всем этим объектам приписывается единый ранг, равный среднеарифметическому значению их порядковых номеров. Об объектах, ранги которых совпадают, говорят, что они имеют связанные ранги. Наличие связанных рангов в выдаче по ранговым тестам обозначается словом "ties" (связи). Обычно выводится число связей и статистика критерия, скорректированная для связей.
В качестве примера построения рангов возьмем упорядоченную информацию об успеваемости 7 студентов.
Средний балл: 3.0 3.1 4.0 4.2 4.2 4.5 5.0
Ранг: 1 2 3 4.5 4.5 6 7
Первые три объекта имеют ранги 1, 2, 3; следующая пара -ранг 4.5 =(4+5)/2, следующая пара - 6 и 7.
5.3.1. Двухвыборочный тест Манна-Уитни (Mann-Witney)-
Критерий предназначен для сравнения распределений переменных в двух группах на основе сравнения рангов.
NPAR TESTS M-W = V14 BY Tp(1,4).
Задание теста аналогично заданию критерия Колмогорова-Смирнова (вместо ключевого слова K-S используется слово M-W).
Статистикой критерия, является сумма рангов объектов в меньшей группе, хотя существует пара эквивалентных формул, обозначаемых U и W. Можно также считать, что критерием является средний ранг в указанной группе. Если он значительно отклоняется от ожидаемой величины (N+1)/2 (или средние ранги в группах существенно различны) - обнаруживается отличие распределений.
Если гипотеза о совпадении распределений не отвергается, то это означает близость средних рангов в группах, не гарантируется совпадение распределений не гарантируется.
Авторам теста удалось показать асимптотическую нормальность статистики в условиях выборки групп из одной совокупности, на основе чего отыскивается наблюдаемая значимость критерия - вероятность случайно отклониться от среднего (ожидаемого) значения ранга больше, чем отклонилось выборочное значение статистики.
В выдаче распечатывается значения статистик U и W, а также двусторонняя значимость критерия.
Пример. Используя ранговый критерий, требуется сравнить по возрасту группу считающих, что острова нужно отдать по юридическим причинам, и группу имеющих иное мнение.
count d2 = v6s1 to v6s8 (2).
if (d2>0) wd2=1.
If (v4=1 or v4=2) wd2 = 2.
npar test m-w=v9 by wd2(1,3).
По величине двусторонней значимости можем сделать вывод, что тест Манна-Уитни в указанных группах не обнаружил существенных различий между распределениями по возрасту (таблицы 5.10-11).
Таблица 5.10. Критерий Манна-Уитни. Суммы рангов.
|
WD2 |
N |
Mean Rank |
Sum of Ranks |
V9 Возраст |
1 |
117 |
116.7 |
13650.5 |
|
2 |
103 |
103.5 |
10659.5 |
|
Total |
220 |
|
|
Таблица 5.11. Критерий Манна-Уитни. Значимость критерия.
|
V9 Возраст |
Mann-Whitney U |
5303.5 |
Wilcoxon W |
10659.5 |
Z |
-1.533 |
Asymp. Sig. (2-tailed) |
0.125 |
5.3.2. Одномерный дисперсионный анализ Краскэла-Уоллиса (Kruskal-Wallis)
В основе сравнения средних рангов заданного числа групп лежит одномерный дисперсионный анализ, в котором вместо значений переменных используются ранги объектов исследуемой переменной.
NPAR TESTS K-W = V14 BY V4(1,3).
В условиях гипотезы равенства распределений в группах нормированный межгрупповой разброс имеет распределение, близкое к распределению хи-квадрат. В выдаче распечатывается значимость этой статистики.
Следующий пример показывает различие доходов жителей населенных пунктов разного типа.
npar test k-w=v9 by tp(1,4).
Таблица 5.12. Тест Краскэла Уоллиса. Средние ранги.
|
TP тип поселен |
N |
Mean Rank |
V14 Ср.мес. душевой доход в семье |
1.00 растущие |
174 |
382 |
|
2.00 стабильные |
230 |
365.2 |
|
3.00 крупные |
201 |
304.6 |
|
4.00 гигант |
68 |
222.2 |
|
Total |
673 |
|
Таблица 5.13. Тест Краскэла-Уоллиса. Значимость критерия.
|
V14 Ср.мес. душевой доход в семье |
Chi-Square |
43.702 |
Df |
3 |
Asymp. Sig. |
0 |
Тест показывает (Sig=0), что точка зрения респондента на иностранную помощь существенно связана типом населенного пункта, в котором он проживает (таблицы 5.12-13).