Название: Экспериментальная психология - Дружинин В.Н.

Жанр: Психология

Рейтинг:

Просмотров: 813


Бирнбаум предложил трехпараметрическую модель, которая позволила бы учесть влияние угадывания на результат выполнения теста.

Трехпараметрическая модель Бирнбаума выглядит так:

Соответственно оценка «силы» пункта (трудности задания) в логистической форме модели

Сj характеризует вероятность правильного ответа на задание j в том случае, если испытуемый угадывал ответ, а не решал задание, т. е. при q ® 0. Для заданий с пятью вариантами ответов Сj становится более пологой, так как 0 < С < 1, но при всех С = 0 кривая поднимается над осью q на величину Сj. Тем самым даже самый неспособный испытуемый не может показать нулевой результат. Дифференцирующая сила тестового задания при введении параметра Сj снижается. Из этого следует нетривиальный вывод: тесты с «закрытыми» заданиями (вынужденным выбором ответа) хуже дифференцируют испытуемых по уровням свойства, чем тесты с «открытыми» заданиями.

Модель Бирнбаума не объясняет парадоксального, но встречающегося в практике тестирования феномена: испытуемый может реже выбирать правильный ответ, чем неправильный. Таким образом, частотарешения некоторых заданий может соответствовать предсказаниями модели Рj < Сj, тогда как, согласно модели Бирнбаума, в пределе Рj = Сj.

Рассмотрим еще одну модель, которую предложил В. С. Аванесов. Как мы заметили, в IRT не решается проблема валидности: успешность решения задач зависит в моделях IRT только от одного свойства. Иначе говоря, каждое задание теста считается априорно валидным.

Аванесов обратил внимание на это обстоятельство и ввел дополнительный, четвертый, параметр, который можно обозначить как внутреннюю валидность задания. Успешность решения задания определяется не только «основной» способностью но и множеством условий, нерелевантных заданию, однако влияющих на деятельность испытуемого.

Четырехпараметрическая модель представляет, по мнению ряда исследовател лишь теоретический интерес:

где gj — валидность тестового задания.

Если gj > 1, то тест не является абсолютно валидным. Следовательно, вероность решения задания не только определяется теоретически выделенным свойством, но и зависит от других психических особенностей личности.

Бирнбаум считает, что количество информации, обеспеченное j-м заданием теста, при оценивании qj является величиной, обратно пропорциональной стандартной ошибке измерения данного значения qj j-м заданием. Более подробно вычисление информационной функции рассмотрено в работе М. Б. Челышковой [ЧелышковаМ. Б., 1995].

Многие авторы, в частности Пол Клайн [Клайн П., 1994], отмечают, что IRT обладает множеством недостатков. Для того чтобы получить надежную и независимую от испытуемых шкалу свойств, требуется провести тестирование большой выборки (не менее 1000 испытуемых). Тестирование достижений показывает, что существуют значительные расхождения между предсказаниями модели и эмпирическими данными.

В 1978 г. Вуд [цит. по: Клайн П., 1994] доказал, что любые произвольные даннь могут быть приведены в соответствие с моделью Раша. Кроме того, существует очен высокая корреляция шкал Раша с классическими тестовыми шкалами (около 0,90).

Шкалирование, по мнению Раша, способно привести к образованию бессмысленных шкал. Например, попытка применить его модель к опроснику EPQ Айзенка породила смесь шкал N, Е, Р и L.

Главный же недостаток IRT — игнорирование проблемы валидности. В психологической практике не наблюдается случаев, когда ответы на задания теста были бы обусловлены лишь одним фактором. Даже при тестировании общего интеллекта модели IRT неприменимы.

Клайн рекомендует использовать модели /ЯГдля коротких тестов с валидными заданиями (факторно простые тесты).

В пособии Клайна «Справочное руководство по конструированию тестов» (Киев, 1994) приведен алгоритм конструирования тестов на основе модели Раша.

В заключение рассмотрим вероятностную модель тестов «уровня» Ф. М. Юсупова [ДружининВ. Н., 1998], аспиранта лаборатории психологии способностей Института психологии РАН. Его модель разработана для тестов с «закрытыми» заданиями (выбором ответов из множества), различающимися по уровню трудности. В «закрытых» тестах испытуемый может применить стратегию «угадывания» ответа Вероятность угадывания


Оцените книгу: 1 2 3 4 5