- •Руководство пользователя по базовой системе Statistics 20
- •Содержание
- •1. Обзор
- •Новые возможности в версии 20
- •Windows
- •Отличие окна назначения от активного окна
- •Строка состояния
- •Диалоговые окна
- •Имена и метки переменных в списках диалоговых окон
- •Изменение размеров диалоговых окон
- •Управляющие элементы диалоговых окон
- •Выбор переменных
- •Получение информации о переменных в диалоговых окнах
- •Основные шаги в анализе данных
- •Репетитор по статистике
- •Получение дополнительной информации
- •2. Получение справки
- •Получение Справки по терминам в выводе
- •3. Файлы данных
- •Открытие файлов данных
- •Как открывать файлы данных
- •Типы файлов данных
- •Параметры открытия файлов
- •Чтение файлов Excel 95 и более поздних версий
- •Чтение файлов Excel старых версий и других электронных таблиц
- •Чтение файлов dBASE
- •Чтение файлов Stata
- •Чтение файлов баз данных
- •Конструктор импорта текстовых файлов SPSS
- •Чтение IBM SPSS Data Collection данных
- •Информация о файле
- •Сохранение файлов данных
- •Как сохранять файлы данных с изменениями
- •Сохранение файлов данных во внешних форматах
- •Сохранение файлов данных в формате Excel
- •Сохранение файлов данных в формате SAS
- •Сохранение файлов данных в формате Stata
- •Сохранение наборов переменных
- •Экспорт в базу данных
- •Экспорт в IBM SPSS Data Collection
- •Защита исходных данных
- •Виртуальный активный файл
- •Кэширование данных
- •4. Режим распределенного анализа
- •Подключение к серверу
- •Добавление и редактирование установок подключения к серверу
- •Поиск доступных серверов
- •Как сохранить файл данных в распределенном режиме анализа
- •Доступ к файлам в режиме локального и распределенного анализа
- •Процедуры анализа, доступные в распределенном режиме анализа данных
- •Сравнение абсолютных и относительных путей
- •5. Редактор данных
- •Закладка Данные
- •Закладка Переменные
- •Как просмотреть или изменить свойства переменных
- •Имена переменных
- •Шкала измерения переменной
- •Тип переменной
- •Метки переменных
- •Метки значений
- •Вставка разрывов строк в метках
- •Пропущенные значения
- •Роли
- •Ширина столбца
- •Выравнивание переменной
- •Применение свойств переменной к нескольким другим переменным
- •Настраиваемые свойства переменной
- •Настройка закладки Переменные
- •Проверка правописания
- •Ввод данных
- •Как вводить числовые данные
- •Как вводить нечисловые данные
- •Как использовать заданные метки значений для ввода данных
- •Ограничения на значения данных в Редакторе данных
- •Редактирование данных
- •Замена или изменение значений данных
- •Удаление, копирование и вставка значений
- •Вставка новых наблюдений
- •Вставка новых переменных
- •Как изменить тип данных
- •Поиск наблюдений, переменных или импутированных значений
- •Поиск и замена значений данных и свойств
- •Состояние отбора наблюдений в Редакторе данных
- •Настройки Редактора данных
- •Печать из Редактора данных
- •Печать содержимого Редактора данных
- •Основные операции с несколькими наборами данных
- •Работа с несколькими наборами данных в командном синтаксисе
- •Копирование и вставка информации из одних наборов данных в другие
- •Переименование наборов данных
- •Скрытие нескольких наборов данных
- •7. Подготовка данных
- •Свойства переменных
- •Задание свойств переменных
- •Как задать свойства переменных
- •Задание меток значений и других свойств переменных
- •Задание шкалы измерения
- •Настраиваемые атрибуты переменной
- •Копирование свойств переменных
- •Присвоение типа измерений переменным с неизвестным типом измерений
- •Наборы множественных ответов
- •Задание наборов множественных ответов
- •Копирование свойств данных
- •Как копировать свойства данных
- •Выбор исходных переменных и переменных назначения
- •Выбор копируемых свойств переменных
- •Копирование свойств наборов (файлов) данных.
- •Результаты
- •Поиск дублирующихся наблюдений
- •Визуальная категоризация
- •Чтобы категоризовать переменные
- •Категоризация переменных
- •Автоматическое формирование категорий интервалов
- •Копирование категорий интервалов
- •Пользовательские пропущенные значения в процедуре Визуальная категоризация
- •8. Преобразование данных
- •Вычисление переменных
- •Вычислить переменную: Отбор наблюдений
- •Вычислить переменную: Тип и метка
- •Функции
- •Пропущенные значения в аргументах функций
- •Генераторы случайных чисел
- •Подсчитать встречаемость значений в наблюдениях
- •Подсчет встречаемости значений в наблюдениях: Подсчитываемые значения
- •Подсчет встречаемости значений: Отбор наблюдений
- •Сдвинуть значения
- •Перекодирование значений
- •Перекодировать в те же переменные
- •Перекодирование в те же переменные: Старые и новые значения
- •Перекодировать в другие переменные
- •Перекодирование в другие переменные: Старые и новые значения
- •Автоматическая перекодировка
- •Ранжировать наблюдения
- •Ранжирование наблюдений: Типы
- •Ранжирование наблюдений: Совпадающие наблюдения
- •Конструктор дат и времени
- •Даты и время в IBM SPSS Statistics
- •Формирование переменной даты/времени из текстовой переменной
- •Создание переменной даты/времени из набора переменных
- •Выполнить сложение и вычитание для переменных дат/времени
- •Выделение части переменной даты/времени
- •Преобразования временных рядов
- •Задать даты
- •Создать временной ряд
- •Заменить пропущенные значения
- •9. Работа с файлами
- •Сортировка наблюдений
- •Сортировать переменные
- •Транспонировать
- •Слияние данных
- •Добавление наблюдений
- •Добавление наблюдений: Переименование переменных
- •Добавление наблюдений: Информация из словаря данных
- •Слияние данных из более чем двух источников
- •Добавление переменных
- •Добавление переменных: Переименование переменных
- •Слияние данных из более чем двух источников
- •Агрегирование данных
- •Агрегирование данных: Агрегирующая функция
- •Агрегирование данных: Имя и метка переменной
- •Расщепить файл
- •Отобрать наблюдения
- •Диалоговое окно Отобрать наблюдения: Если
- •Диалоговое окно Отобрать наблюдения: Случайная подвыборка
- •Диалоговое окно Отобрать наблюдения: Размах
- •Взвесить наблюдения
- •Реструктуризация данных
- •Как реструктурировать данные
- •Конструктор реструктуризации данных: Выберите тип
- •Конструктор реструктуризации данных (переменные в наблюдения): Количество групп переменных
- •Конструктор реструктуризации данных (переменные в наблюдения): Выбрать переменные
- •Конструктор реструктуризации данных (переменные в наблюдения): Создать индексные переменные
- •Конструктор реструктуризации данных (переменные в наблюдения): Создать одну индексную переменную
- •Конструктор реструктуризации данных (переменные в наблюдения): Создание нескольких индексных переменных
- •Конструктор реструктуризации данных (переменные в наблюдения): Параметры
- •Конструктор реструктуризации данных (наблюдения в переменные): Выбрать переменные
- •Конструктор реструктуризации данных (наблюдения в переменные): Сортировка данных
- •Конструктор реструктуризации данных (наблюдения в переменные): Параметры
- •Конструктор реструктуризации данных: Завершение работы
- •10. Работа с выводом результатов
- •Система просмотра
- •Показ и скрытие результатов
- •Изменение исходного выравнивания
- •Изменение выравнивания элементов вывода
- •Схема вывода
- •Добавление элементов во Viewer
- •Поиск и замена информации во Viewer
- •Копирование вывода в другие приложения
- •Экспортировать вывод
- •Параметры HTML
- •Параметры Word/RTF
- •Параметры Excel
- •Параметры экспорта в PowerPoint
- •Параметры PDF
- •Параметры текста
- •Параметры только для графики
- •Параметры графических форматов
- •Печать документов Viewer
- •Печать вывода и диаграмм
- •Предварительный просмотр
- •Атрибуты страницы: Параметры
- •Сохранение результатов
- •Сохранение документа Viewer
- •11. Мобильные таблицы
- •Управление мобильной таблицей
- •Активация мобильной таблицы
- •Трансформация таблицы
- •Изменение порядка отображения элементов внутри размерности
- •Перемещение строк и столбцов в пределах одной размерности
- •Транспонирование строк и столбцов
- •Группирование строк или столбцов
- •Разгруппирование строк или столбцов
- •Поворот меток строк или столбцов
- •Отмена изменений
- •Работа со слоями
- •Создание и показ слоев
- •Перейти к категории слоя
- •Отображение и скрытие объектов
- •Скрытые строк и столбцов в таблице
- •Отображение скрытых строк и столбцов в таблице
- •Скрытие и отображение меток измерений
- •Отображение и скрытие заголовков таблицы
- •Шаблоны таблиц
- •Применить шаблон таблиц
- •Как отредактировать или создать шаблон таблиц
- •Свойства таблицы
- •Как изменить свойства мобильной таблицы
- •Свойства таблицы: общие
- •Свойства таблицы: сноски
- •Свойства таблицы: формат ячеек
- •Свойства таблицы: границы
- •Свойства таблицы: печать
- •Свойства ячеек
- •Шрифт и фон
- •Формат значения
- •Выравнивание и поля
- •Сноски и заголовки
- •Добавление сносок и заголовков
- •Чтобы скрыть или отобразить заголовок
- •Маркер сноски
- •Перенумерация сносок
- •Редактирование сносок в устаревшей таблице
- •Ширина ячеек данных
- •Изменение ширины столбца
- •Отображение скрытых границ в мобильной таблице
- •Печать мобильных таблиц
- •Управление разбивкой таблицы для широких и длинных таблиц
- •Создание диаграммы из мобильной таблицы
- •Устаревшие таблицы
- •12. Модели
- •Взаимодействие с моделью
- •Работа со Средством просмотра моделей
- •Печать моделей
- •Экспорт модели
- •Сохранение полей, использованных в модели в новом наборе данных
- •Сохранение предикторов в новом наборе данных на основе их важности
- •Модели для ансамблей
- •Сводка для модели
- •Важность предикторов
- •Частота предикторов
- •Точность моделей компонентов
- •Подробности о моделях компонентов
- •Автоматическая подготовка данных
- •Средство просмотра расщепленных моделей
- •13. Работа с командным синтаксисом
- •Правила синтаксиса
- •Вставка команд из диалоговых окон
- •Вставка команд из диалоговых окон
- •Копирование синтаксиса из журнала во Viewer
- •Как скопировать синтаксис из журнала в выводе
- •Работа с Редактором синтаксиса
- •Окно Редактора синтаксиса.
- •Терминология
- •Автозавершение
- •Цветовое кодирование
- •Контрольные точки
- •Закладки
- •Закомментирование или раскомментирование текста
- •Форматирование синтаксиса
- •Выполнение командного синтаксиса
- •Файлы синтаксиса Юникод
- •Несколько команд Execute
- •14. Обзор графических возможностей
- •Создание и редактирование диаграммы
- •Построение диаграмм
- •Редактирование диаграмм
- •Параметры построения диаграмм
- •Добавление и изменение заголовков и сносок
- •Задание общих параметров
- •15. Скоринг данных с использованием прогнозных моделей
- •Конструктор скоринга
- •Сопоставление полей модели и полей набора данных
- •Выбор функций скоринга
- •Скоринг активного набора данных
- •Объединение XML-файлов модели и преобразований
- •16. Сервис
- •Информация о переменной
- •Комментарии к файлу данных
- •Наборы переменных
- •Задание наборов переменных
- •Использование наборов переменных для отображения и скрытия переменных
- •Изменение порядка переменных в списках выбранных переменных
- •Работа с пакетами расширений
- •Создание пакетов расширений
- •Установка пакетов расширений
- •Обзор установленных пакетов расширений
- •17. Параметры
- •Общие параметры
- •Параметры Viewer
- •Параметры данных
- •Изменение стандартного представления переменных
- •Параметры валют
- •Как создать пользовательский формат валюты
- •Параметры в закладке Метки в выводе
- •Параметры диаграмм
- •Цвета элементов данных
- •Линии элементов данных
- •Маркеры элементов данных
- •Заливка элементов данных
- •Параметры мобильных таблиц
- •Параметры местоположения файлов
- •Параметры скриптов
- •Параметры Редактора синтаксиса
- •Параметры множественной импутации
- •18. Настройка меню и панелей инструментов
- •Редактор меню
- •Настройка панелей инструментов
- •Отображение панелей инструментов
- •Как настраивать панели инструментов
- •Свойства панели инструментов
- •Изменить панель инструментов
- •Создание нового инструмента
- •19. Создание настраиваемых диалоговых окон и управление ими
- •Структура Конструктора настраиваемого диалогового окна
- •Создание настраиваемого диалогового окна
- •Свойства диалогового окна
- •Указание местоположения меню для настраиваемого диалогового окна
- •Компоновка управляющих элементов на макете
- •Создание шаблона синтаксиса
- •Предварительный просмотр настраиваемого диалогового окна
- •Управление настраиваемыми диалоговыми окнами
- •Типы управляющих элементов
- •Исходный список
- •Целевой список
- •Фильтрация списков переменных
- •Флажок
- •Поле со списком и элементы управления поля со списком
- •Поле ввода текста
- •Поле ввода чисел
- •Статическое текстовое поле
- •Группа элементов
- •Группа переключателей
- •Группа флажков
- •Обозреватель файлов
- •Кнопка вложенного диалога
- •Настраиваемые диалоговые окна для команд расширения
- •Создание локализованных версий настраиваемых диалоговых окон
- •20. Производственные задания
- •Файлы синтаксиса
- •Выходные результаты
- •Параметры HTML
- •Параметры PowerPoint
- •Параметры PDF
- •Параметры текста
- •Производственные задания с командами OUTPUT
- •Значения в рабочем цикле
- •Параметры запуска
- •Подключение к серверу
- •Добавление и редактирование установок подключения к серверу
- •Запросы к пользователям
- •Состояние фонового задания
- •Запуск производственных заданий из командной строки
- •Преобразование файлов производственного режима
- •Типы объектов вывода
- •Идентификаторы команд и подтипы таблиц
- •Метки
- •Параметры OMS
- •Журнал
- •Не выводить во Viewer
- •Направление вывода в файлы данных IBM SPSS Statistics
- •Пример: Одна двумерная таблица
- •Пример: Таблицы со слоями
- •Управление элементами столбцов для управления переменными в файле данных
- •Имена переменных в генерируемых с помощью OMS файлах данных
- •Структура таблицы OXML
- •OMS-идентификаторы
- •Копирование идентификаторов OMS из панели схемы Viewer
- •22. Скрипты
- •Автоскрипты
- •Создание автоскриптов
- •Связывание существующих скриптов с объектами Viewer
- •Выполнение скриптов Python и программ Python
- •Редактор скриптов для языка программирования Python
- •Написание скриптов в Basic
- •Объект scriptContext
- •Стартовый скрипт
- •Указатель
133
Подготовка данных
Визуальная категоризация
Процедура Визуальная категоризация предназначена для оказания помощи в создании новых переменных на основе группирования непрерывных значений существующих переменных в ограниченное количество различающихся категорий. Визуальную категоризацию можно использовать, чтобы
Создавать категориальные переменные из непрерывных числовых переменных. Например, Вы можете на основе количественной переменной Доход создать новую категориальную переменную, которая будет содержать категории дохода.
Преобразовывать большое число категорий порядковой переменной в меньшее число категорий. Например, Вы можете сократить число категорий шкалы оценок с девяти до трех: низкая, средняя и высокая.
На первом этапе нужно
EВыбрать числовые количественные и/или порядковые переменные, на основе которых нужно создать новые категориальные переменные.
Рисунок 7-15
Стартовое диалоговое окно выбора переменных для разбиения
Дополнительно Вы можете ограничить число сканируемых наблюдений. В файлах данных с большим числом наблюдений ограничение числа сканируемых наблюдений может существенно сэкономить время, однако этого следует, по возможности, избегать, поскольку это влияет на распределение значений, используемых в последующих расчетах процедурой Визуальная категоризация.
Примечание: Текстовые переменные и номинальные числовые переменные не отображаются в списке исходных переменных. Процедура Визуальная категоризация требует числовых переменных, измеренных в количественной или порядковой шкале,
134
Глава 7
поскольку предполагается, что значения данных имеют некоторый логический порядок, который можно использовать для естественной группировки значений. Вы можете изменить тип шкалы измерений переменной на закладке Переменные в Редакторе данных. Дополнительную информацию см. данная тема Шкала измерения переменной в Данная глава 5 на стр. 80.
Чтобы категоризовать переменные
E Выберите в меню в окне Редактора данных:
Преобразовать > Визуальная категоризация...
EВыбрать числовые количественные и/или порядковые переменные, на основе которых нужно создать новые категориальные переменные.
E Выберите переменную в списке Отсканированные переменные.
EВведите имя новой категоризованной переменной. Имена переменных должны быть уникальными и должны соответствовать правилам для имен переменных. Дополнительную информацию см. данная тема Имена переменных в Данная глава 5 на стр. 79.
EЗадайте критерии категоризации для новой переменной. Дополнительную информацию см. данная тема Категоризация переменных на стр. 134.
E Щелкните по ОК.
Категоризация переменных
Рисунок 7-16
Визуальная категоризация, главное диалоговое окно
135
Подготовка данных
В главном диалоговом окне процедуры Визуальная категоризация представляется следующая информация по отсканированным переменным:
Список отсканированных переменных. В списке выводятся переменные, которые Вы выбрали в стартовом диалоговом окне. Вы можете отсортировать список по уровню измерений (количественный или порядковый), а также по имени или метке переменной, щелкнув по заголовку столбца.
Просканировано наблюдений. Выводится число отсканированных наблюдений. Все отсканированные наблюдения без пользовательских и системных пропущенных значений для выбранной переменной используются для формирования распределения значений, используемых в вычислениях в процедуре Визуальная категоризация, включая гистограмму в главном диалоговом окне и пороговые точки на основе процентилей или единиц стандартных отклонений.
Пропущенные значения. Выводится число отсканированных наблюдений с пользовательскими или системными пропущенными значениями. Пропущенные значения не включаются ни в одну из категорий интервалов. Дополнительную информацию см. данная тема Пользовательские пропущенные значения в процедуре Визуальная категоризация на стр. 141.
Текущая переменная. Имя и метка (если задана) текущей выбранной переменной, которая будет использоваться для создания новой, категоризованной переменной.
Новая переменная: Имя и необязательная метка новой, категоризованной переменной.
Имя. Вы должны ввести имя новой переменной. Имена переменных должны быть уникальными и должны соответствовать правилам для имен переменных. Дополнительную информацию см. данная тема Имена переменных в Данная глава 5 на стр. 79.
Метка. Вы можете ввести описательную метку переменной длиной до 255 символов. По умолчанию используется метка (если задана) или имя исходной переменной с добавленным словом (Категоризовано).
Минимум и максимум. Минимальное и максимальное значения текущей выбранной переменнойпоотсканированнымнаблюдениям, невключаяпользовательскиепропущенные значения.
Непропущенные значения. Гистограмма отображает распределение непропущенных значений текущей выбранной переменной на основе отсканированных наблюдений.
После того как Вы определили интервалы для новой переменной, на гистограмме появляются вертикальные линии, обозначающие границы интервалов.
Вы можете перетаскивать линии границ интервалов на гистограмме, изменяя ширину интервалов.
Вы можете удалять интервалы, перетаскивая линий границ за пределы гистограммы.
Примечание: Гистограмма (отображающая непропущенные значения), минимальное и максимальное значения основываются на отсканированных наблюдениях. Если
сканировались не все наблюдения, распределение значений может неточно соответствовать фактическому распределению значений в файле, в особенности, если файл был
136
Глава 7
отсортирован по выбранной переменной. Если сканировалось ноль наблюдений, информация о распределении значений недоступна.
Сетка. Отображаются значения, определяющие верхние границы интервалов, и необязательные метки для каждого интервала.
Значение. Значения, определяющие верхние границы интервалов. Вы можете ввести значения или воспользоваться кнопкой Границы интервалов, чтобы автоматически создать интервалы на основе заданных критериев. По умолчанию, автоматически включается граница интервала со значением ВЫСОКИЙ. Этот интервал будет включать все непропущенные значения, превышающие значения остальных границ интервалов. Интервал, определяемый наименьшим значением границ интервалов, будет включать все непропущенные значения, меньшие либо равные этому значению (или просто меньшие этого значения, в зависимости от того, как вы определили верхние границы интервалов).
Метка. Необязательные описательные метки значений новой, разбитой переменной. Поскольку значениями новой переменной будут просто числа от 1 до n, метки, описывающие, что представляют эти значения, являются очень полезными. Вы можете ввести метки вручную или воспользоваться кнопкой Создать метки, чтобы автоматически создать метки значений.
Как удалить интервал в сетке:
EЩелкните правой кнопкой мыши по ячейке Значение или Метка интервала, который необходимо удалить.
EИз контекстного меню выберите Удалить строку.
Примечание: Если Вы удалите интервал ВЫСОКИЙ, всем наблюдениям, имеющим значения выше последнего заданного значения границы интервала, будут в новой переменной назначены системные пропущенные значения.
Как удалить все метки или все заданные интервалы:
E Щелкните правой кнопкой мыши в любом месте сетки.
EИз контекстного меню выберите Удалить все метки или Удалить все границы.
Верхние границы. Определяет интерпретацию верхних границ интервалов в столбце
Значение в сетке.
Включены (<=). Наблюдения, имеющие значение, заданное в ячейке Значение в сетке, включаются в категорию интервала. Например, если Вы задали значения 25, 50 и 75, то наблюдения со значением 25 попадут в первый интервал, поскольку в интервал включаются все значения меньшие либо равные 25.
Исключены (<). Наблюдения, имеющие значение, заданное в ячейке Значение в сетке, включаются в категорию интервала. Эти значения включаются в следующий интервал. Например, если Вы задали значения 25, 50 и 75, то наблюдения со значением 25 попадут во второй интервал, поскольку в первый интервал попадают наблюдения со значениями меньшими 25.
