Оценки шкальные

Найдено 2 определения

Показать: [все] [проще] [сложнее]

Автор: [российский] Время: [советское] [современное]

Оценки шкальные

способ сценки результатов по тесту путем установления его места на специальной измерительной шкале. Шкала содержит данные о внутригрупповых нормах выполнения данной методики в выборке стандартизации. О. ш. имеют четко определенное количественное содержание и могут быть использованны при статистическом анализе результатов.

Источник: Основные понятия психодиагностики и экспериментальной психологии. Cловарь 2006

ОЦЕНКИ ШКАЛЬНЫЕ

способ оценки результата теста путем установления его места на специальной шкале. Шкала содержит данные о внутригрупповых нормах выполнения данной методики в выборке стандартизации. Так, индивидуальное выполнение заданий (оценки
первичные испытуемых) сравнивается с их выполнением в сопоставимой нормативной группе (напр., результат, достигнутый учеником, сравнивается с показателями детей того же возраста или года обучения; результат исследования общих способностей
взрослого сопоставляется со статистически обработанными показателями репрезентативной выборки лиц в заданных возрастных пределах).
О. т. в этом смысле имеют четко определенное количественное содержание и могут быть использованы при статистическом анализе.
Одной из распространенных в психологической диагностике форм оценивания результата теста путем соотнесения с групповыми данными является расчет процентилей. Процентиль — процентная доля индивидов из выборки стандартизации, результат которых ниже
данного первичного показателя. Шкалу процентилей можно рассматривать как совокупность ранговых градаций (см. КОРРЕЛЯЦИЯ РАНГОВАЯ) при числе рангов 100 и отсчете от 1-го ранга, соответствующего самому низкому результату; 50-й процентиль (Р50)
соответствует медиане (см. МЕРЫ ЦЕНТРАЛЬНОЙ ТЕНДЕНЦИИ) распределения результатов, Я>50 и P<50 соответственно представляют ранги результатов выше и ниже среднего уровня результата.
Процентили не следует смешивать с обычными процентными показателями. Последние представляют собой долю правильных решений из общего количества заданий теста в индивидуальном результате (см. ОЦЕНКИ ПЕРВИЧНЫЕ). Ранги Р1 и Р100 получают соответственно
самый низкий и самый высокий результаты из наблюдавшихся в выборке, однако этим рангам могут соответствовать и далеко не нулевой (ни одного правильного решения) или абсолютный (все решения правильны) показатели. Такая ситуация наблюдается,
напр., при оценке тестов скорости.
Основной недостаток процентильных шкал состоит в неравномерности единиц измерения. При нормальном распределении отдельные переменные тесно группируются в центре распределения и по мере удаления к краям рассеиваются. Поэтому равным частотам случаев
вблизи центра соответствуют более короткие интервалы по оси абсцисс, расположенные по краям распределения оценок. Процентили показывают относительное положение каждого испытуемого в нормативной выборке, но не величину различий между результатами.
Это создает некоторые неудобства в интерпретации индивидуальных результатов. Так, разница в первичных показателях, соответствующая интервалу Р70—Р60, может составить 10 баллов, а различие в количестве правильных решений в интервале рангов
Р50—Р60 — лишь 1—3 балла.
Вместе с тем процентильные оценки обладают и рядом достоинств. Они легко доступны пониманию пользователей психодиагностической информацией, универсальны по отношению к различным типам методик и легко рассчитываются.
Процентильные оценки не относятся к типичным шкальным показателям. Более широкое распространение в психодиагностике получили стандартные показатели, рассчитываемые на основе линейного или нелинейного преобразования первичных показателей, распределенных
по нормальному или близкому к нормальному закону. При таком расчете проводится z-преобразованне оценок (см. СТАНДАРТИЗАЦИЯ, НОРМАЛЬНОЕ РАСПРЕДЕЛЕНИЕ). Чтобы определить г-стандартный показатель, определяют разность между индивидуальным первичным
результатом и средним значением для нормативной группы, а затем делят эту разность на σ нормативной выборки. Полученная таким образом шкала z (рис. 36) имеет среднюю точку М = 0, отрицательные значения обозначают результаты ниже среднего
и убывают по мере удаления от нулевой точки; положительные значения обозначают соответственно результаты выше среднего. Единица измерения (масштаб) в шкале z равна 1σ стандартного (единичного) нормального распределения.

Для преобразования полученного при стандартизации распределения первичных нормативных результатов в стандартную z-шкалу необходимо исследовать вопрос о характере эмпирического распределения и степени его согласованности с нормальным (см. ОЦЕНКА
ТИПА РАСПРЕДЕЛЕНИЯ).
Поскольку для большинства случаев значения показателей в распределении умещаются в пределах

, единицы измерения простой z-шкалы слишком велики. Для удобства оценивания применяется
еще одно преобразование типа

. Примером такой шкалы могут быть оценки тестовой батареи SAT(СЕЕВ) методики для оценки способности к обучению (см. тесты достижений). Эта z-шкала
пересчитана таким образом, что средней точке соответствует значение 500, а

. Другим аналогичным примером является шкала Векслера для отдельных субтестов (см. шкала измерения интеллекта
Векслера), где М = 10,

.
Наряду с определением места индивидуального результата в стандартном распределении групповых данных введение О. ш. направлено и па достижение другой важнейшей цели — обеспечение сопоставимости количественных результатов различных тестов, выраженных
в стандартных шкалах, возможности их совместной интерпретации, сведение оценок к единой системе.
В случае, если оба распределения оценок в сравниваемых методиках близки к нормальному, вопрос о сопоставимости оценок решается довольно просто (в любом нормальном распределении интервалам М ± п σ соответствует одинаковая частота случаев).
Для обеспечения сопоставимости результатов, принадлежащих к распределениям другой формы, применяются нелинейные преобразования, позволяющие придать распределению форму заданной теоретической кривой. В качестве такой кривой обычно используется
нормальное распределение. Как и при простом г-преобразовании, нормализованным стандартным показателям можно придать любую желаемую форму. К примеру, умножив такой нормализованный стандартный показатель на 10 и прибавив константу 50, получаем
Т-показатель (см. СТАНДАРТИЗАЦИЯ, МИННЕСОТСКИЙ МНОГОАСПЕКТНЫЙ ЛИЧНОСТНЫЙ ОПРОСНИК).
Примером нелинейно преобразованной в стандартную шкалу является и шкала станайнов (англ. standard nine — стандартная девятка), где оценки принимают значения от 1 до 9, М = 5, σ ≈ 2.
Шкала станайнов получает все большее распространение, сочетая в себе достоинства стандартных шкальных показателей н простоту процентилей. Первичные показатели легко преобразуются в станайны. Для этого испытуемые ранжируются по возрастанию результатов,
и из них образуются группы с числом лиц, соответствующих определенным частотам оценок в нормальном распределении тестовых результатов (табл. 18).
Пусть в выборке стандартизации 200 человек, тогда по 8 (4 %) испытуемых, имеющих самые низкие и самые высокие оценки, будут отнесены к 1 и 9 станайнам соответственно. Процедура продолжается до заполнения всех интервалов шкалы. Соответствующие
процентным градациям баллы по тесту, таким образом, будут упорядочены в шкалу, соответствующую стандартным частотам распределения результата.

Одной из наиболее распространенных форм О. ш. в тестах интеллекта является IQ-показа-тель стандартный (М = 100, σ ≈ 16). Эти параметры для стандартной шкалы оценок в психодиагностике выбраны в качестве эталонных. Как видно из рис. 36,
существует довольно много шкал, опирающихся на стандартизацию; их оценки легко сводимы друг к другу. Шкалирование, в принципе, допустимо и желательно для широкого круга методик, применяемых в диагностических и исследовательских целях, в том
числе и для методик, результаты которых выражены в качественных показателях. В этом случае для стандартизации можно использовать перевод номинативных шкал в ранговые (см. ШКАЛЫ ИЗМЕРИТЕЛЬНЫЕ) или разработать дифференцированную систему количественных
первичных оценок.

Следует отметить, что при всей простоте, наглядности шкальные показатели являются статистическими характеристиками, позволяющими лишь указать на место данного результата в выборке из множества аналогичных по характеру измерений. Шкальный показатель
даже для традиционного психометрического инструмента является лишь одной из форм выражения показателей теста из всего массива информации, используемой при интерпретации результатов обследования. Количественный анализ при этом должен всегда
проводиться в комплексе с многосторонним качественным изучением причин возникновения данного тестового результата с учетом как комплекса сведений о личности испытуемого, так и данных о текущих условиях обследования, надежности и валидности
методики. Гипертрофированные представления о возможности обоснованных заключений лишь по количественным оценкам приводили к многим ошибочным представлениям в теории и практике психологической диагностики (см. ИНТЕЛЛЕКТА КОЭФФИЦИЕНТ, ТЕСТЫ
ИНТЕЛЛЕКТА).

Источник: Словарь-справочник по психологической диагностике 1989 г.