Добавил:
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз: Предмет: Файл:

Психодиагностика теоретические основы. Учебное пособие

.pdf
Скачиваний:
3
Добавлен:
08.09.2026
Размер:
2 Мб
Скачать
☆
111
1
том из пилотажной батареи. Компьютер позволяет использовать более эф­фективный алгоритм, основанный на анализе частных корреляций между критерием и пунктами и предполагающий построение уравнения множест­венной регрессии. В результате в таком уравнении каждый пункт получает весовой коэффициент, количественно выражающий его вклад в критерий, не сводимый к вкладу других пунктов, т. е. поиск оптимального набора пунктов автоматизируется.
После отбора валидных пунктов должна быть произведена перекре­стная валидизация1. Чтобы убедиться в том, что отобранные пункты теста действительно могут различать (или прогнозировать) критерий, нужно рассмотреть, как коррелируют с критерием эти пункты на другой выборке, которая не использовалась при их отборе.
Простой метод реализации принципа перекрестной валидизации со­стоит в том, что вся выборка делится на две случайные половины, и произ­водится раздельный расчет корреляций пунктов с критерием каждой поло­вины выборки. Если выделенные (значимые) пункты совпадают, то пере­крестную валидизацию можно считать удачной.
Метод критериального тестирования очень трудоемок. Пpaктически невозможно построить критериальный тест за счет одной статистики, сколь бы мощными выборками и батареями заданий мы ни располагали. Необходима работа над содержательной валидностью заданий. Критери­альное тестирование имеет ограниченное применение в задачах построе­ния методик с широкой областью применения.
Следует еще раз подчеркнуть, что анализ валидности отдельных пунктов служит не только прагматическим целям, но может и должен слу­жить целям углубления представлений о содержательно-теоретическом смысле измеряемого свойства; на основании содержательного анализа пунктов, отобранных по критерию, психолог уточняет-корректирует свою первоначальную теоретическую схему, свое понимание измеряемого свой­ства.
Таким образом, многообразие видов валидности связано с разнооб­разием тестов и целей тестирования. В табл. 11 приводится валидность одного и того же теста применительно к разным целям (по Анастази).
Анастази, А. Психологическое тестирование: Книга 1. / под ред. К.М. Гуревича,
В.И. Лубовского. Предисловие: К.М.Гуревича, В.И. Лубовского. - М.: Педагогика,
1982. С. 197.
112
Цель тестирования
Вопрос, на который должен ответить тест
Тип валидности
Тестирование достиже­ний по арифметике в средних классах школы
Что Дик усвоил на се­годняшний день?
По содержанию
Тестирование способ­ностей для предсказа­ния возможности ос­воения курса математи­ки в старших классах
Как Джим будет учить­ся в дальнейшем?
Прогностическая отно­сительно критерия
Диагностирование трудностей в обучении
Выявило ли выполне­ние теста Биллом ка­кие-то трудности в обучении?
Текущая относительно критерия
Тестирование логиче­ского мышления
Как можно охарактери­зовать психическую деятельность Генри?
Конструктная
Достоверность самоотчета
Таблица 11
Валидность одного и того же теста применительно к разным целям
Рассматривая общую проблему ва-
лидности, целесообразно выделить вопрос об обеспечении валидности процедур
стандартизованного самоотчета. Сюда относятся различные техники шка­лирования, классифицирования, сравнения и тест-опросники. Вербальная форма тестового материала порождает у испытуемого определенные встречные гипотезы о целях тестирования. Если ситуация диктует туемому необходимость фальсификации ответов, то он редко отказывается от этой возможности.
Валидность - характеристика любых измерений, в том числе и физических. Специфические проблемы валидности, связанные с активностью человека как объекта психодиагностики, целесообразно обозначить особым образом - проблемы обеспечения достоверности.
Психологические факторы, от которых зависит достоверность само­отчета, условно можно сгруппировать в следующие классы:
113
Наиболее часто используемые вари-
анты «борьбы» с социальной желательно­стью:
введение «шкал лжи», состоящих из
вопросов-ловушек, когда ответы на эти вопросы явно предопределены социальной желательностью или «шкал коррекции» с последующим внесением поправок к баллу по дру­гим шкалам;
устранение или сбалансирование соци-
альной желательности с помощью использования инструкции на пред­намеренную фальсификацию резуль­татов: «Заполните опросник от лица человека, желающего произвести са­мое благоприятное впечатление».
1. Факторы знания. У испытуемого может быть более или менее
четкое представление о следующем: а) свойственно ли ему в действитель­ности или нет тестируемое поведенческое проявление (с некоторыми си­туациями, имплицитно подразумеваемыми в вопросе тест-опросника, ис­пытуемый мог на практике никогда не встречаться: например, утвержде­ние «После выигрыша в спортлото Вы покупаете больше лотерейных би­летов» подразумевает, что испытуемый, во-первых, играет в спортлото и, во-вторых, выигрывает); б) какое личностное свойст­во скрывается у психолога за тем или иным конкретным поведением, описанным в суждении; в) как это свойство соотносится с общепринятыми моральными нормами и признаками соци­ального успеха.
2. Фактор социальной
желательности. Обозначает
тенденцию испытуемого да­вать о себе социально одоб­ряемую информацию. Сила этой тенденции зависит как от общей внеситуативной уста­новки испытуемого на морали­зацию «Я-образа» и социаль­ную успешность, так и от того, насколько эту установку ак­туализирует сама ситуация тестирования. Однако эта тен­денция не будет давать систематического искажения, если испытуемые не смогут разгадать направленность теста-опросника и связать диагностируе­мое свойство с тем или иным полюсом социальной желательности. Таким образом, действие этого фактора до некоторой степени опосредовано дей­ствием факторов знания. Однако при диагностике личностных свойств, тесно связанных с психической «нормальностью» или «социальной ус­пешностью», фактор социальной желательности ответа обусловливает очень серьезные искажения.
3. Факторы индивидуальной тактики. Здесь подразумевается действие «Я-концепции» («Я» для себя) и «Я-образа» («Я» для других) на ситуативную тактику испытуемого в момент тестирования.
114
Порядок действий психолога
при проверке валидности
Выполняя тест, испытуемый всегда находится в невольном диалоге с самим собой и в своих ответах на вопросы раскрывает себя не только для других, но и для себя самого. Испытуемый стремится подтвердить «Я­концепцию» или фальсифицировать определенный «Я-образ» с заданными свойствами. Как правило, в ситуациях высокого социального риска «Я-образ» полностью доминирует: например, преступник при экс­пертизе стремится прежде всего предстать больным или неприспособленным к жизни, хотя в действительности ему было бы приятно думать о себе как о вполне адаптированном здоровом человеке. Точно так же склонны подчеркивать свои трудности и проблемы клиенты, обратившиеся за помощью к психологу или психотерапевту (чтобы вы­звать к себе его повышенное внимание). В менее регламентированных си­туациях, наоборот, может доминировать мотивация самопознания: в этом случае испытуемый невольно стремится подтвердить с помощью теста свои гипотезы о самом себе.
Заслуживают внимания и особые формы отказа испытуемого от тес-
тирования: позиционный стиль ответа (соглашательство или, наоборот, от­рицание), случайные ответы. Для выявления подобных отказов обычно достаточно довольно простых мер: 1) для исключения влияния соглаша­тельства (отрицания) применяются перечни с «прямыми» (ответ «верно» в пользу измеряемого свойства) и «обратными» (ответ «неверно» в пользу измеряемого свойства) пунктами. Кроме того, производится подсчет ба­ланса подтверждающих и отвергающих ответов: если баланс резко нару­шается, то протокол признается бракованным; 2) для выявления случайных ответов в большие перечни вводят вопросы-дубли (синонимические пере­фразы) или прямые повторы: если испытуемый слишком часто по-разному отвечает на одинаковые вопросы, значит он применяет случайную тактику. Вводят также и крайне редкие утверждения, с которыми испытуемые, как правило, соглашаются только по ошибке.
ные подходы к обеспечению валидности, обусловленные теоретико­методологическими различиями определенных психологических школ для прагматически ориентированных тестологов (каковыми традиционно являлись до недавнего времени почти все англо-американские специалисты) главный
Очень трудно выделить универсаль-
ный алгоритм работы психолога по про­верке валидности, ибо существуют различ-
115
момент - поиск операционально строго заданного социально-прагматического критерия валидности, по отношению к которому диагностические тесты и их составные части (пункты) подбираются как бы автоматически - в ходе эмпири­ко-статистических процедур сбора и корреляционного анализа результатов. Но, конечно, неверно было бы приписывать этому подходу «бездумность в опоре на статистику»: ведь статистика только тогда позволяет выявить валидное под­множество пунктов, когда исходное множество подобрано не случайно, а с ис­пользованием априорных корректных содержательно-психологических пред­ставлений.
Современные методологи психологического тестирования фактически
единодушно приходят к признанию (как наиболее оптимальной) рационально­эмпирической стратегии конструирования теста и проверки валидности. Пере­числим этапы этой стратегии.
1. Теоретический анализ диагностического конструкта, разработка теоретической концепции тестируемого психического свойства. Выявление (с использованием литературы) системы взаимосвязанных диагностических кон­структов, внутри которой новый диагностический конструкт характеризуется определенными структурно-функциональными связями и отношениями. Про­гнозирование результатов корреляционных экспериментов по проверке кон­структной валидности.
2. Выделение составных частей теоретического конструкта, фор- мулирование системы «эмпирических индикаторов» - операционально одно­значных показателей, фиксирующих проявление конструкта в различных поведенческих ситуациях. Конструирование пунктов теста.
3. Формулирование релевантного социально-прагматического критерия для проверки валидности.
4. Планирование и проведение корреляционного исследования
(или квазиэксперимента) на специально подобранной выборке испытуемых, для которых известно значение критериального показателя, а также резуль­таты по родственным психологическим тестам. При необходимости для этих испытуемых проводятся дополнительные тесты с целью получить воз­можность корреляционной проверки конструктной валидности теста (экс­пертные оценки в данном случае рассматриваются в статусе одной из воз­можных параллельных процедур получения критериальной или психологи­ческой информации). Оценка валидности эмпирических индикаторов.
5. Исследование достоверности результатов (если используется са- моотчет, и диагностическая ситуация может быть воспринята испытуемы­ми с настороженностью). Оценка достоверности эмпирических индикаторов.
116
Отсев пунктов, не удовлетворяющих критериям валидности и досто­верности. Измерение надежности для сокращенной шкалы, состоящей толь­ко из валидных пунктов. Если надежность оказывается невысокой, то пси­холог снова возвращается к этапу 1 – уточняет теоретические представле­ния.
Библиографический список
1. Анастази, А. Психологическое тестирование: Книга 1. / под ред.
К.М. Гуревича, В.И. Лубовского. Предисловие: К.М.Гуревича,
В.И. Лубовского. - М.: Педагогика, 1982. - 320 с., ил.
2. Анастази, А., Урбина С. Психологическое тестирование / А. Анаста-
зи, С. Урбина. – СПб: Питер, 2001. - 688 с., ил. – (Серия «Мастера
психологии»). - ISBN 5-272-00106-0; ISBN 5-0-02-303085-2 (англ).
3. Бодалев, А.А., Столин В.В. Общая психодиагностика / А.А. Бодалев,
В.В. Столин. - СПб.: Издательство ―Речь‖, 2000. - 440 с. - ISBN 5-
9268-0026-1.
4. Бурлачук, Л.Ф., Морозов С.М. Словарь-справочник по психодиаг-
ностике / Л.Ф. Бурлачук, С.М. Морозов. - СПб.: Изд-во ―Питер‖,
2000. - 528 с. - ISBN 5-88782-336-4.
Терминологический минимум
(темы 2.1 – 2.3)
Выборка - группа лиц, выбранных для участия в исследовании (тес-
тировании) из генеральной совокупности.
Выборка стандартизации – часть генеральной совокупности, ре-
презентативная для той популяции, для которой предназначен тест,
на которой и определяется норма.
Генеральная совокупность – множество объектов, эквивалентных
по конечному множеству свойств.
Измерение - процедура, с помощью которой измеряемый объект
сравнивается с некоторым эталоном и получает числовое выражение
в определенном масштабе или шкале.
Коэффициент интеллекта или IQ – это отношение умственного
возраста (УВ) к хронологическому возрасту (ХВ), умноженное на
100. Стандартные показатели IQ из разных тестов сравнимы лишь в
тех случаях, когда в их шкалах используются одинаковые или
близкие по величине σ. Величину стандартного отклонения следует
всегда указывать в руководстве к тесту и учитывать пользователем.
117
Если при построении какой-либо шкалы стандартного IQ выбирается
иное σ, чем в других тестах, то и смысловое значение любого кон-
кретного IQ по такому тесту будет существенно отличаться от его
смыслового значения в других тестах.
Медиана (Ме) - результат, находящийся в середине последователь-
ности показателей, если их расположить в порядке возрастания или
убывания. Медиана - точка, делящая распределение ровно пополам,
причем одна половина результатов лежит справа от нее, а другая -
слева.
Мода (Мо) - наиболее часто встречающийся результат. В частотном
распределении мода определяется как середина интервала, для кото-
рого частота максимальна.
Норма в психодиагностике указывает на среднее (или нормальное)
выполнение. Если обычные 8-летние дети правильно решают 12 за-
дач из 50 в тесте на типичное арифметическое рассуждение, значит
норма для 8-летнего в этом тесте соответствует показателю 12. Лю-
бая норма ограничивается конкретной совокупностью людей, для
которой она вырабатывалась. Определяется на выборке стандартиза-
ции.
Нормализованные стандартные показатели — это стандартные
показатели, выраженные в единицах распределения, которое было
преобразовано с целью его приведения к виду нормальной кривой.
Нормализованные стандартные показатели выражаются в той же
форме, что и линейно преобразованные стандартные показатели, т. е.
имеют среднее М= 0 и стандартное отклонение σ = 1.
Понятия признака и переменной могут использоваться как взаимо-
заменяемые.
Популяция – естественное множество индивидов, обладающих оп-
ределенным набором свойств, потенциальные участники исследова-
ния, часть генеральной совокупности.
Признаки и переменные - это измеряемые психологические явле-
ния.
Процентили. Процентильные показатели выражаются в единицах
процента лиц, составляющих выборку стандартизации, результат ко-
торых ниже установленной первичной оценки. Например, если 28 %
людей решают правильно меньше 15 задач в тесте арифметического
рассуждения, то первичная («сырая») оценка 15 соответствует 28-му
процентилю (Р28). Процентиль показывает относительное положение
индивидуума в выборке стандартизации.
118
Процент
4 7 12
17
20
17
12 7 4
Станайн
1 2 3 4 5 6 7 8 9
Распределение - закономерность встречаемости разных его зна-
чений.
Распределение нормальное – вид распределения переменных. Ха-
рактеризуется тем, что крайние значения признака в нем встречают-
ся достаточно редко, а значения, близкие к средней величине, - дос-
таточно часто. График уравнения нормального распределения пред-
ставляет собой симметричную унимодальную колоколообразную
кривую, осью симметрии которой является вертикаль (ордината),
проведенная через точку 0.
Репрезентативность выборки – соответствие свойств исследуемой
выборки свойствам генеральной совокупности. Чтобы быть репре-
зентативной для данной популяции, выборка должна быть выверена
по географическому распределению, социоэкономическому уровню,
этническому составу и др. существенным характеристикам. Другая
выборка, отобранная подобным образом не должна приводить к
нормам, заметно отличным от полученных.
Станайн – нелинейный стандартный показатель, шкала перевода
первичных показателей в станайны, где используются только одно-
значные числа (от 1 до 9). Среднее значение показателя =5. Первич-
ные показатели легко преобразуются в станайны упорядочиванием
числовых значений и приписыванием им новых значений в соответ-
ствии с нормальной кривой процентов, приведенной ниже.
Стандартизация теста подразумевает единообразие процедуры
проведения и оценки выполнения теста. С. включает точные указа-
ния относительно используемых материалов, временных ограниче-
ний, устных инструкций испытуемому, способов трактовки вопросов
и др. Стандартизация теста осуществляется на выборке стандартиза-
ции, на которой и определяется норма.
Стандартные показатели - это показатели, выражающие отличие
индивидуального результата от среднего в единицах стандартного
отклонения соответствующего распределения. Стандартные показа-
тели, получаемые линейным преобразованием, часто называют
просто «стандартными показателями» или «z-показателями». Чтобы
вычислить z-показатель, находят разность между первичной оценкой
119
Расчет стандартных показателей
MX
Z
М = 60
σ = 5
езультат Элен
Результат Билла
0,1
5
6065
1Z
4,0
5
6058
2Z
индивидуума и средним для нормативной группы и затем делят эту
разность на σ нормативной группы.
Шкала - это форма фиксации совокупности признаков изучаемого
объекта с упорядочиванием их в определенную числовую систему.
Шкала интервальная - это шкала, классифицирующая по принци-
пу «больше на определенное количество единиц - меньше на опре-
деленное количество единиц». Шкала представляет собой полно-
стью упорядоченный ряд с измеренными интервалами между пунк-
тами, причем отсчет начинается с произвольно выбранной величи-
ны. Каждое из возможных значений признака отстоит от другого на
равном расстоянии.
Шкала порядковая - это шкала, классифицирующая по принципу
«больше – меньше». Здесь субъекты ранжированы, например, по
весу или росту. В порядковой шкале должно быть не менее трех
классов, например, «положительная реакция - нейтральная реакция -
отрицательная реакция».
Шкала равных отношений - это шкала, классифицирующая объ-
екты или субъектов пропорционально степени выраженности изме-
ряемого свойства. В отличие от интервальной шкалы она имеет
значимую нулевую точку, которая не произвольна, а указывает на
полное отсутствие измеряемого свойства. В шкалах отношений
классы обозначаются числами, которые пропорциональны друг
другу: 2 так относится к 4, как 4 к 8.
Шкала номинативная (шкала наименований) - это шкала, класси-
фицирующая по названию: nomen (лат.) - имя, название. Название
же не измеряется количественно, оно лишь позволяет отличить один
объект от другого.
120
Терминологический минимум
(темы 2.4.1 – 2.4.2)
Надежность в психометрии означает согласованность показателей,
полученных у тех же самых испытуемых при повторном тестирова-
нии тем же самым тестом или эквивалентной его формой.
Надежность ретестовая - коэффициент корреляции между резуль-
татами тестирования одним и тем же тестом через небольшой отре-
зок времени.
Надежность параллельных (взаимозаменяемых) форм –
коэффициент корреляции между результатами тестирования двумя
формами теста (А и Б) через небольшой отрезок времени.
Надежность внутренней согласованности - коэффициент интер-
корреляционных связей между заданиями, составляющими тест.
Надежность расщепления - метод основан на однократном предъ-
явлении единственной формы теста, но благодаря разбиению зада-
ний теста каждый испытуемый получает два результата (четные за-
дания и нечетные). Если несколько заданий относятся к одному изо-
бражению, то они все относятся в одну из половин.
Надежность Кьюдера-Ричардсона - метод основан на однократном
предъявлении единственной формы теста, использует согласован-
ность ответов по всем заданиям теста. Коэффициент представляет
собой при всех возможных разбиениях теста надвое среднее значе-
ние коэффициентов, найденных методом расщепления и вычисляет-
ся по формуле:
Надежность оценщика - метод основан на однократном предъяв-
лении единственной формы теста, использует согласованность оце-
нок протоколов выполнения теста двумя специалистами независимо
друг от друга. Используется в тестах креативности и проективных
личностных тестах.
Валидность - это степень, в которой тест действительно измеряет то,
для чего он предназначен.
Валидность по содержанию – один из основных типов валидности
методики, характеризующий степень репрезентативности содержа-
ния заданий теста измеряемой области психических свойств. Явля-
ется адекватным средством оценки тестов достижений. Она позволя-
ет установить, охватывает ли тест репрезентативную выборку кон-
кретных навыков и знаний и свободно ли выполнение теста от влия-
ния посторонних факторов.
Валидность очевидная – это то, насколько тест кажется ценным для
испытуемого, официальных лиц, принимающих решение об его ис-
Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]