Статьи →  Эффективность психологических тестов


Конструирование тестаПрежде всего, необходимо четко представлять себе то психологическое свойство, которое будет измерять будущий тест. Ни один тест не создается "с нуля", обычно за его созданием стоит длительная научная работа по изучению тематического материала.

Перед конструктором психологического теста стоит сложная задача — наиболее полно отразить все стороны измеряемого психологического свойства через минимальное количество заданий. Последнее условие — один из критериев эффективности теста. Это не означает, что личностный опросник Кеттела, содержащий полтысячи вопросов, можно считать неэффективным. При таком большом количестве измеряемых личностных факторов (16) такое количество вопросов является оптимальным. То же касается тестов на интеллект, мотивацию и другие обширные психические сферы. Остерегаться следует опросника, скажем, на стремление к риску, содержащего 250 вопросов.

Кроме этих требований, тест должен соответствовать целевой группе, на которую он направлен. Разрабатываются задания соответствующей сложности и доступности для разных возрастных групп, для людей с различными психическими нарушениями, для представителей разных национальных и языковых групп. Если тест предлагается к проведению в другой языковой группе или стране, его необходимо адаптировать.


К адаптации относятся не только перевод заданий, но и перестройка фраз, понятий, замена фразеологизмов, пословиц и поговорок на аналогичные им в данном языке. Смысл вопросов должен передаваться с учетом религиозных взглядов данной группы.

Также необходимо учитывать и некоторые эффекты, наблюдаемые при заполнении людьми тестовых заданий. Так называемый эффект социальной желательности срабатывает тогда, когда человек в своих ответах хочет представить себя в лучшем свете. Многие тесты вооружены до зубов "шкалами лжи", вопросами-ловушками и пр. Но и это не всегда помогает — человек находит одинаковые вопросы, держит в памяти свои ответы.

Есть еще один прием — подмена цели теста в инструкции, если эта цель вообще открывается испытуемому. Тогда человек, отвечая на вопросы, показывает себя хорошо с одной стороны (ложная цель) и дает более или менее достоверные сведения о другой стороне (истинная цель), которая на самом деле измеряется данным тестом.

Существуют и требования к формулировке вопросов, к порядку их расстановки в тесте. Они опять же зависят от целевой группы, на которую тест рассчитан.

Правильно составленный тест еще нельзя назвать разработанным. Для этого он должен быть стандартизован.

СтандартизацияСтандартизация теста обеспечивает возможность сравнения полученных с его помощью данных от разных людей. Для этого необходимо, чтобы все эти люди находились в равных условиях. На психологическом языке это называется "контроль всех зависимых переменных". В идеале единственной независимой переменной в тесте будет личность испытуемого. Для обеспечения равных условий разработчик теста дает специальные указания по его проведению. Они включают:

Специфику стимульного материала
Временные ограничения (time limits)
Инструкцию испытуемым
Пробные образцы заданий
Допустимые ответы на вопросы (если таковые ограничения необходимы)
Кроме этих указаний, в приложение к тесту включаются специально установленные нормы ответов (в "сырых баллах") и их интерпретации.

Помимо стандартизации тест должен быть проверен на предмет своей эффективности по критериям надежности и валидности. Очень часто эти понятия делают взаимозаменяемыми, поэтому рассмотрим, какое значение имеет каждое из них.

НадежностьПод надежностью понимают согласованность результатов, полученных при каждом повторном выполнении теста одним и тем же испытуемым, с результатами его первого тестирования. Абсолютной тестовой надежности не существует, погрешности допускаются, однако чем они выше, тем ниже тестовая эффективность. Надежность можно проверить следующими методами:

тест-ретестовая надежность подразумевает многократное выполнение одного теста и корреляционное сравнение полученных результатов.
разделенная надежность определяется при делении теста на две части и сравнение результатов выполнения двух частей по отдельности.
эквивалентная надежность выявляется путем предъявления испытуемому теста и его альтернативного варианта. Полученные результаты также сравниваются между собой.
ВалидностьПсихологические словари раскрывают понятие валидности как степени соответствия теста своему назначению измерять то, для чего он создан; действительной способности теста измерять ту психологическую характеристику, для диагностики которой он заявлен. Количественно валидность теста может выражаться через корреляции результатов, полученных с его помощью, с другими показателями, например, с успешностью выполнения соответствующей деятельности.

Кроме того, валидность теста можно установить, сравнивая его результаты с результатами по аналогичным методикам. К примеру, разработанный тест на вербальный интеллект можно провести вместе с известным тестом Амтхауэра, сравнив затем их результаты. Высокая корреляция результатов будет означать высокую валидность — значит, новый тест действительно измеряет вербальный интеллект, а не речевые способности, память, внимание и т.д.

Выше было сказано про ошибки на этапе использования теста. Нарушение условий его проведения, рекомендуемых в приложениях, может привести к снижению валидности. Допустим, мы проводим тест на запоминание слов и, видя, что испытуемый достаточно способный, увеличиваем скорость прочтения списка слов. В этом случае увеличение скорости будет дополнительной независимой переменной, проще говоря, помехой. В результате вместо скорости запоминания мы будем измерять стрессоустойчивость личности.

Оценка валидности теста включает следующие этапы:определение очевидной валидности (face validity). Такую валидность видно, что говорится, "невооруженным глазом" — оценивается общее соответствие теста его назначению.
определение концептуальной валидности (construct validity). Степень соответствия теста, измеряющего какое-либо свойство, общепринятым теоретическим представлениям об этом свойстве. Как правило, эта валидность оценивается экспертами.
определение эмпирической валидности (empirical validity). Выбирается критерий (независимая переменная), с которой связываются результаты теста. К примеру, критерием для теста готовности к школе может стать общая оценка успеваемости первоклассника.
определение содержательной валидности (content validity). Разработанный тест должен включать вопросы для оценки максимально возможного числа параметров того свойства, которое этот тест измеряет (выше упоминалось первое правило составления теста — максимальное количество параметров свойства через минимальное количество заданий). Эта валидность также оценивается с помощью экспертных оценок.
Кстати, не только новые тесты проходят такой экзамен. В настоящее время многие исследователи заняты анализом эффективности уже известных тестов. Недавняя полемика на страницах психологического журнала "Psychological Science in the Public Interest" поставила под сомнение эффективность таких "мэтров" психодиагностических инструментов, как тест чернильных пятен Роршаха, ТАТ (тест тематической апперцепции) и проективный тест-рисунок фигуры человека. Оказалось, что эти психодиагностические методики имеет низкую эмпирическую валидность, низкую тест-ретестовую надежность и некорректно составленные нормативные показатели.

Вышеприведенные методы оценки эффективности теста помогают психологу не только самому конструировать инструменты для измерения определенных свойств личности, но и выбирать из уже разработанных тестов наиболее качественные и надежные.


Схожие статьи:

Определение воображения
Задачи современной психологии
Основные стадии протекания конфликта
Владимир Карпов. Психотерапия с позиции системной психодинамики
Человек-масса. Анатомический срез
Ассоциации как способ запоминания
Психопатии и акцентуации характера у подростков
Деловой завтрак, обед, ужин
Цели групп психокоррекции
Требования к руководителям по исследованию М.Вудкока и Д.Фрэнсиса
Идея перфекционизма
ИСПОЛЬЗОВАНИЕ АУТОСТИМУЛЯЦИИ РЕБЕНКА
Понятие личности
Интеллект
Сознание
Классификация социальных объединений в психологии
Диалектическая теория конфликта Ральфа Дарендорфа
Развитие психики
БОРЬБА ЗА ОГОНЬ (В ГЛАЗАХ)
Первичная терапия в телесной психотерапии
Стадии подготовки к беседе при приеме на работу
Происхождение и развитие психики
Модели общения основанные на стилях и как они влияют на эффективность управленческого общения
Влияние личностных качеств на общение
Возможности для увеличения числа потребителей
Социальные процессы
Основные процедуры тренинга умений
Основные функции чувств
Исследования лидерства К. Левина
Классификация явлений мышления
Речь. Виды речи
Какие моменты следует избегать при увольнении работника (по С.А. Джессеферу)
Общие рекомендации по решению конфликтной ситуации
Привлечение внимания покупателя
ТЕ, КОТОРЫХ МЫ ПОТЕРЯЛИ
Общее понятие о психике
Темперамент
Особенности планирования
Вопросы материального стимулирования
Эмоциональный аспект рекламного воздействия
Границы поведения животных и психологическая деятельность человека
Практические упражнения в группах встреч
Шаг к успеху, или как стать общительным
Виды деятельности
Аспекты эмоций
Особенности Я-концепции в ранней юности
Общая характеристика привычек
Некоторые эффекты и законы памяти
Выражение веселья и радости
ХОЛДИНГ-ТЕРАПИЯ
Черты характера
Природа конфликта в организации
Виды мышления
Телесная терапия вкратце
Темперамент и личность


Новости: