
- •Руководство пользователя по базовой системе Statistics 20
- •Содержание
- •1. Обзор
- •Новые возможности в версии 20
- •Windows
- •Отличие окна назначения от активного окна
- •Строка состояния
- •Диалоговые окна
- •Имена и метки переменных в списках диалоговых окон
- •Изменение размеров диалоговых окон
- •Управляющие элементы диалоговых окон
- •Выбор переменных
- •Получение информации о переменных в диалоговых окнах
- •Основные шаги в анализе данных
- •Репетитор по статистике
- •Получение дополнительной информации
- •2. Получение справки
- •Получение Справки по терминам в выводе
- •3. Файлы данных
- •Открытие файлов данных
- •Как открывать файлы данных
- •Типы файлов данных
- •Параметры открытия файлов
- •Чтение файлов Excel 95 и более поздних версий
- •Чтение файлов Excel старых версий и других электронных таблиц
- •Чтение файлов dBASE
- •Чтение файлов Stata
- •Чтение файлов баз данных
- •Конструктор импорта текстовых файлов SPSS
- •Чтение IBM SPSS Data Collection данных
- •Информация о файле
- •Сохранение файлов данных
- •Как сохранять файлы данных с изменениями
- •Сохранение файлов данных во внешних форматах
- •Сохранение файлов данных в формате Excel
- •Сохранение файлов данных в формате SAS
- •Сохранение файлов данных в формате Stata
- •Сохранение наборов переменных
- •Экспорт в базу данных
- •Экспорт в IBM SPSS Data Collection
- •Защита исходных данных
- •Виртуальный активный файл
- •Кэширование данных
- •4. Режим распределенного анализа
- •Подключение к серверу
- •Добавление и редактирование установок подключения к серверу
- •Поиск доступных серверов
- •Как сохранить файл данных в распределенном режиме анализа
- •Доступ к файлам в режиме локального и распределенного анализа
- •Процедуры анализа, доступные в распределенном режиме анализа данных
- •Сравнение абсолютных и относительных путей
- •5. Редактор данных
- •Закладка Данные
- •Закладка Переменные
- •Как просмотреть или изменить свойства переменных
- •Имена переменных
- •Шкала измерения переменной
- •Тип переменной
- •Метки переменных
- •Метки значений
- •Вставка разрывов строк в метках
- •Пропущенные значения
- •Роли
- •Ширина столбца
- •Выравнивание переменной
- •Применение свойств переменной к нескольким другим переменным
- •Настраиваемые свойства переменной
- •Настройка закладки Переменные
- •Проверка правописания
- •Ввод данных
- •Как вводить числовые данные
- •Как вводить нечисловые данные
- •Как использовать заданные метки значений для ввода данных
- •Ограничения на значения данных в Редакторе данных
- •Редактирование данных
- •Замена или изменение значений данных
- •Удаление, копирование и вставка значений
- •Вставка новых наблюдений
- •Вставка новых переменных
- •Как изменить тип данных
- •Поиск наблюдений, переменных или импутированных значений
- •Поиск и замена значений данных и свойств
- •Состояние отбора наблюдений в Редакторе данных
- •Настройки Редактора данных
- •Печать из Редактора данных
- •Печать содержимого Редактора данных
- •Основные операции с несколькими наборами данных
- •Работа с несколькими наборами данных в командном синтаксисе
- •Копирование и вставка информации из одних наборов данных в другие
- •Переименование наборов данных
- •Скрытие нескольких наборов данных
- •7. Подготовка данных
- •Свойства переменных
- •Задание свойств переменных
- •Как задать свойства переменных
- •Задание меток значений и других свойств переменных
- •Задание шкалы измерения
- •Настраиваемые атрибуты переменной
- •Копирование свойств переменных
- •Присвоение типа измерений переменным с неизвестным типом измерений
- •Наборы множественных ответов
- •Задание наборов множественных ответов
- •Копирование свойств данных
- •Как копировать свойства данных
- •Выбор исходных переменных и переменных назначения
- •Выбор копируемых свойств переменных
- •Копирование свойств наборов (файлов) данных.
- •Результаты
- •Поиск дублирующихся наблюдений
- •Визуальная категоризация
- •Чтобы категоризовать переменные
- •Категоризация переменных
- •Автоматическое формирование категорий интервалов
- •Копирование категорий интервалов
- •Пользовательские пропущенные значения в процедуре Визуальная категоризация
- •8. Преобразование данных
- •Вычисление переменных
- •Вычислить переменную: Отбор наблюдений
- •Вычислить переменную: Тип и метка
- •Функции
- •Пропущенные значения в аргументах функций
- •Генераторы случайных чисел
- •Подсчитать встречаемость значений в наблюдениях
- •Подсчет встречаемости значений в наблюдениях: Подсчитываемые значения
- •Подсчет встречаемости значений: Отбор наблюдений
- •Сдвинуть значения
- •Перекодирование значений
- •Перекодировать в те же переменные
- •Перекодирование в те же переменные: Старые и новые значения
- •Перекодировать в другие переменные
- •Перекодирование в другие переменные: Старые и новые значения
- •Автоматическая перекодировка
- •Ранжировать наблюдения
- •Ранжирование наблюдений: Типы
- •Ранжирование наблюдений: Совпадающие наблюдения
- •Конструктор дат и времени
- •Даты и время в IBM SPSS Statistics
- •Формирование переменной даты/времени из текстовой переменной
- •Создание переменной даты/времени из набора переменных
- •Выполнить сложение и вычитание для переменных дат/времени
- •Выделение части переменной даты/времени
- •Преобразования временных рядов
- •Задать даты
- •Создать временной ряд
- •Заменить пропущенные значения
- •9. Работа с файлами
- •Сортировка наблюдений
- •Сортировать переменные
- •Транспонировать
- •Слияние данных
- •Добавление наблюдений
- •Добавление наблюдений: Переименование переменных
- •Добавление наблюдений: Информация из словаря данных
- •Слияние данных из более чем двух источников
- •Добавление переменных
- •Добавление переменных: Переименование переменных
- •Слияние данных из более чем двух источников
- •Агрегирование данных
- •Агрегирование данных: Агрегирующая функция
- •Агрегирование данных: Имя и метка переменной
- •Расщепить файл
- •Отобрать наблюдения
- •Диалоговое окно Отобрать наблюдения: Если
- •Диалоговое окно Отобрать наблюдения: Случайная подвыборка
- •Диалоговое окно Отобрать наблюдения: Размах
- •Взвесить наблюдения
- •Реструктуризация данных
- •Как реструктурировать данные
- •Конструктор реструктуризации данных: Выберите тип
- •Конструктор реструктуризации данных (переменные в наблюдения): Количество групп переменных
- •Конструктор реструктуризации данных (переменные в наблюдения): Выбрать переменные
- •Конструктор реструктуризации данных (переменные в наблюдения): Создать индексные переменные
- •Конструктор реструктуризации данных (переменные в наблюдения): Создать одну индексную переменную
- •Конструктор реструктуризации данных (переменные в наблюдения): Создание нескольких индексных переменных
- •Конструктор реструктуризации данных (переменные в наблюдения): Параметры
- •Конструктор реструктуризации данных (наблюдения в переменные): Выбрать переменные
- •Конструктор реструктуризации данных (наблюдения в переменные): Сортировка данных
- •Конструктор реструктуризации данных (наблюдения в переменные): Параметры
- •Конструктор реструктуризации данных: Завершение работы
- •10. Работа с выводом результатов
- •Система просмотра
- •Показ и скрытие результатов
- •Изменение исходного выравнивания
- •Изменение выравнивания элементов вывода
- •Схема вывода
- •Добавление элементов во Viewer
- •Поиск и замена информации во Viewer
- •Копирование вывода в другие приложения
- •Экспортировать вывод
- •Параметры HTML
- •Параметры Word/RTF
- •Параметры Excel
- •Параметры экспорта в PowerPoint
- •Параметры PDF
- •Параметры текста
- •Параметры только для графики
- •Параметры графических форматов
- •Печать документов Viewer
- •Печать вывода и диаграмм
- •Предварительный просмотр
- •Атрибуты страницы: Параметры
- •Сохранение результатов
- •Сохранение документа Viewer
- •11. Мобильные таблицы
- •Управление мобильной таблицей
- •Активация мобильной таблицы
- •Трансформация таблицы
- •Изменение порядка отображения элементов внутри размерности
- •Перемещение строк и столбцов в пределах одной размерности
- •Транспонирование строк и столбцов
- •Группирование строк или столбцов
- •Разгруппирование строк или столбцов
- •Поворот меток строк или столбцов
- •Отмена изменений
- •Работа со слоями
- •Создание и показ слоев
- •Перейти к категории слоя
- •Отображение и скрытие объектов
- •Скрытые строк и столбцов в таблице
- •Отображение скрытых строк и столбцов в таблице
- •Скрытие и отображение меток измерений
- •Отображение и скрытие заголовков таблицы
- •Шаблоны таблиц
- •Применить шаблон таблиц
- •Как отредактировать или создать шаблон таблиц
- •Свойства таблицы
- •Как изменить свойства мобильной таблицы
- •Свойства таблицы: общие
- •Свойства таблицы: сноски
- •Свойства таблицы: формат ячеек
- •Свойства таблицы: границы
- •Свойства таблицы: печать
- •Свойства ячеек
- •Шрифт и фон
- •Формат значения
- •Выравнивание и поля
- •Сноски и заголовки
- •Добавление сносок и заголовков
- •Чтобы скрыть или отобразить заголовок
- •Маркер сноски
- •Перенумерация сносок
- •Редактирование сносок в устаревшей таблице
- •Ширина ячеек данных
- •Изменение ширины столбца
- •Отображение скрытых границ в мобильной таблице
- •Печать мобильных таблиц
- •Управление разбивкой таблицы для широких и длинных таблиц
- •Создание диаграммы из мобильной таблицы
- •Устаревшие таблицы
- •12. Модели
- •Взаимодействие с моделью
- •Работа со Средством просмотра моделей
- •Печать моделей
- •Экспорт модели
- •Сохранение полей, использованных в модели в новом наборе данных
- •Сохранение предикторов в новом наборе данных на основе их важности
- •Модели для ансамблей
- •Сводка для модели
- •Важность предикторов
- •Частота предикторов
- •Точность моделей компонентов
- •Подробности о моделях компонентов
- •Автоматическая подготовка данных
- •Средство просмотра расщепленных моделей
- •13. Работа с командным синтаксисом
- •Правила синтаксиса
- •Вставка команд из диалоговых окон
- •Вставка команд из диалоговых окон
- •Копирование синтаксиса из журнала во Viewer
- •Как скопировать синтаксис из журнала в выводе
- •Работа с Редактором синтаксиса
- •Окно Редактора синтаксиса.
- •Терминология
- •Автозавершение
- •Цветовое кодирование
- •Контрольные точки
- •Закладки
- •Закомментирование или раскомментирование текста
- •Форматирование синтаксиса
- •Выполнение командного синтаксиса
- •Файлы синтаксиса Юникод
- •Несколько команд Execute
- •14. Обзор графических возможностей
- •Создание и редактирование диаграммы
- •Построение диаграмм
- •Редактирование диаграмм
- •Параметры построения диаграмм
- •Добавление и изменение заголовков и сносок
- •Задание общих параметров
- •15. Скоринг данных с использованием прогнозных моделей
- •Конструктор скоринга
- •Сопоставление полей модели и полей набора данных
- •Выбор функций скоринга
- •Скоринг активного набора данных
- •Объединение XML-файлов модели и преобразований
- •16. Сервис
- •Информация о переменной
- •Комментарии к файлу данных
- •Наборы переменных
- •Задание наборов переменных
- •Использование наборов переменных для отображения и скрытия переменных
- •Изменение порядка переменных в списках выбранных переменных
- •Работа с пакетами расширений
- •Создание пакетов расширений
- •Установка пакетов расширений
- •Обзор установленных пакетов расширений
- •17. Параметры
- •Общие параметры
- •Параметры Viewer
- •Параметры данных
- •Изменение стандартного представления переменных
- •Параметры валют
- •Как создать пользовательский формат валюты
- •Параметры в закладке Метки в выводе
- •Параметры диаграмм
- •Цвета элементов данных
- •Линии элементов данных
- •Маркеры элементов данных
- •Заливка элементов данных
- •Параметры мобильных таблиц
- •Параметры местоположения файлов
- •Параметры скриптов
- •Параметры Редактора синтаксиса
- •Параметры множественной импутации
- •18. Настройка меню и панелей инструментов
- •Редактор меню
- •Настройка панелей инструментов
- •Отображение панелей инструментов
- •Как настраивать панели инструментов
- •Свойства панели инструментов
- •Изменить панель инструментов
- •Создание нового инструмента
- •19. Создание настраиваемых диалоговых окон и управление ими
- •Структура Конструктора настраиваемого диалогового окна
- •Создание настраиваемого диалогового окна
- •Свойства диалогового окна
- •Указание местоположения меню для настраиваемого диалогового окна
- •Компоновка управляющих элементов на макете
- •Создание шаблона синтаксиса
- •Предварительный просмотр настраиваемого диалогового окна
- •Управление настраиваемыми диалоговыми окнами
- •Типы управляющих элементов
- •Исходный список
- •Целевой список
- •Фильтрация списков переменных
- •Флажок
- •Поле со списком и элементы управления поля со списком
- •Поле ввода текста
- •Поле ввода чисел
- •Статическое текстовое поле
- •Группа элементов
- •Группа переключателей
- •Группа флажков
- •Обозреватель файлов
- •Кнопка вложенного диалога
- •Настраиваемые диалоговые окна для команд расширения
- •Создание локализованных версий настраиваемых диалоговых окон
- •20. Производственные задания
- •Файлы синтаксиса
- •Выходные результаты
- •Параметры HTML
- •Параметры PowerPoint
- •Параметры PDF
- •Параметры текста
- •Производственные задания с командами OUTPUT
- •Значения в рабочем цикле
- •Параметры запуска
- •Подключение к серверу
- •Добавление и редактирование установок подключения к серверу
- •Запросы к пользователям
- •Состояние фонового задания
- •Запуск производственных заданий из командной строки
- •Преобразование файлов производственного режима
- •Типы объектов вывода
- •Идентификаторы команд и подтипы таблиц
- •Метки
- •Параметры OMS
- •Журнал
- •Не выводить во Viewer
- •Направление вывода в файлы данных IBM SPSS Statistics
- •Пример: Одна двумерная таблица
- •Пример: Таблицы со слоями
- •Управление элементами столбцов для управления переменными в файле данных
- •Имена переменных в генерируемых с помощью OMS файлах данных
- •Структура таблицы OXML
- •OMS-идентификаторы
- •Копирование идентификаторов OMS из панели схемы Viewer
- •22. Скрипты
- •Автоскрипты
- •Создание автоскриптов
- •Связывание существующих скриптов с объектами Viewer
- •Выполнение скриптов Python и программ Python
- •Редактор скриптов для языка программирования Python
- •Написание скриптов в Basic
- •Объект scriptContext
- •Стартовый скрипт
- •Указатель

129
Подготовка данных
Результаты
Рисунок 7-13
Конструктор копирования свойств данных: Шаг 5
На последнем шаге Конструктора копирования свойств данных предоставляется информация о числе переменных, свойства которых будут скопированы из исходного файла данных, количестве новых переменных, которые будут созданы в рабочем файле данных, и количестве свойств наборов данных или свойствах файла, которые будут скопированы.
Вы можете также вставить сгенерированный командный синтаксис в окно Редактора синтаксиса и сохранить его для использования в дальнейшем.
Поиск дублирующихся наблюдений
Причины появления “дублирующихся” наблюдений могут быть разными:
Ошибки ввода данных, когда одно и то же наблюдение случайно было введено более одного раза.
Один и тот же первичный идентификационный номер у нескольких наблюдений, но разные вторичные идентификационные номера, как например у наблюдений, относящиеся к членам одной семьи.
Несколько наблюдений относятся к одному объекту наблюдения, но значения переменных, кроме той, по которой этот объект был идентифицирован, отличаются, например, покупки, совершенные человеком или организацией в разные периоды времени.

130
Глава 7
Процедура Поиск дублирующихся наблюдений позволяет выявить дубли почти во всех возможных случаях и предоставляет возможность управлять процессом автоматического разделения наблюдений на уникальные и дублирующиеся.
Чтобы выявить дублирующиеся наблюдения:
E Выберите в меню:
Данные > Поиск дублирующихся наблюдений...
EВыберите одну или несколько (ключевых) переменных, по которым будет вестись поиск дублирующихся наблюдений.
EВыберите один или несколько параметров в группе Создать переменные. Дополнительно Вы можете:
EВыбрать одну или несколько переменных для сортировки наблюдений внутри групп, задаваемых переменными, по которым ведется поиск дублирующихся наблюдений. Порядок сортировки, заданный этими переменными, определяет “первое” и “последнее” наблюдение в каждой группе. Если сортировка дублирующихся наблюдений не задана, используется порядок наблюдений в исходном файле.
EДублирующиеся наблюдения можно отфильтровывать автоматически, чтобы не включать их в отчеты, диаграммы и расчеты статистик.

131
Подготовка данных
Рисунок 7-14
Диалоговое окно Поиск дублирующихся наблюдений
Поиск дублирующих наблюдений по: Наблюдения считаются дублирующимися, если их значения совпадают по всем выбранным переменным. Если Вы хотите обнаружить только те наблюдения, которые совпадают на 100%, выберите все переменные.
Сортировка внутри групп дублирующихся наблюдений по: Наблюдения автоматически сортируются по переменным, по которым ведется поиск дублирующихся наблюдений. Вы можете выбрать переменные для дополнительной сортировки. Эти переменные будут определять порядок наблюдений в каждой группе дублирующихся наблюдений.
Для любой переменной сортировки можно выбрать сортировку в порядке возрастания или в порядке убывания.
Если выбрать несколько переменных сортировки, наблюдения сортируются
по значениям каждой переменной внутри категорий, задаваемых значениями предшествующей переменной в списке сортирующих. Например, если выбрать дата в качестве первой переменной для сортировки и количество в качестве второй переменной сортировки, то наблюдения будут отсортированы по количеству внутри каждой даты.

132
Глава 7
Для изменения порядка переменных сортировки используйте кнопки в виде стрелок вверх и вниз справа от списка.
Порядок сортировки определяет “первое” и “последнее” наблюдения в каждой группе совпадающих наблюдений, что, в свою очередь, определяет значение необязательной индикаторной переменной уникальных наблюдений. Например, если Вы хотите отфильтровать (удалить) все наблюдения в каждой группе, кроме последних, можно отсортировать наблюдения в порядке возрастания по переменной дата, в результате чего последние по дате наблюдения будут последними в группе.
Индикатор уникальных наблюдений. Создается переменная, принимающая значение 1 для уникальных наблюдений и значение 0 для неуникальных наблюдений в каждой группе.
Уникальным может быть первое или последнее наблюдение в каждой группе дублирующихся (совпадающих) наблюдений, которые определяются порядком сортировки внутри групп. Если не задать переменные для сортировки, порядок наблюдений в каждой группе определяется исходным порядком наблюдений в файле.
Вы можете использовать индикаторную переменную в качестве фильтрующей переменной для исключения дублирующихся наблюдений из отчетов и анализа без удаления этих наблюдений из файла данных.
Счетчик дублирующихся наблюдений в каждой группе. Создается переменная с последовательным номером от 1 до n для наблюдений в каждой группе дублирующихся наблюдений. Последовательность определяется текущим порядком наблюдений в каждой группе, который может соответствовать исходному порядку наблюдений в файле или задаваться переменными сортировки.
Переместить дублирующиеся наблюдения в верхнюю часть файла данных. Файл данных сортируется таким образом, что все группы дублирующихся наблюдений оказываются в верхней части файла, что облегчает просмотр дублирующихся наблюдений в Редакторе данных.
Вывод частот для созданных переменных. Частотные таблицы с частотами для каждой созданной переменной. Например, для переменной-индикатора уникальных наблюдений в таблице приводится число наблюдений, имеющих значение 0 в этой переменной, что показывает количество дублей, и число наблюдений, имеющих значение 1 в этой переменной, что соответствует количеству уникальных наблюдений.
Пропущенные значения. В числовых переменных системные пропущенные значения обрабатываются аналогично другим значениям — наблюдения с пропущенными значениями в переменной, по которой ведется поиск дублирующихся наблюдений, рассматриваются как дублирующиеся по этой переменной. В текстовых переменных наблюдения, в которых пропущены значения переменной, по которой ведется поиск дублирующихся наблюдений, рассматриваются как дублирующиеся по этой переменной.