Шкала Терстоуна: метод равнокажущихся интервалов

Шкала Терстоуна нужна, когда исследователь хочет превратить отношение к объекту в числовую позицию на континууме: от резко отрицательной до резко положительной. В отличие от обычного вопроса «насколько вы согласны», здесь сначала калибруют сами утверждения. Группа судей располагает фразы по предполагаемой силе отношения, а затем исследователь выбирает те, которые образуют равномерную шкалу.
Метод называют шкалой равнокажущихся интервалов. Его исходная идея появилась в работах Луиса Терстоуна в 1928 году: отношение группы к вопросу можно представить как распределение позиций на прямой, если измеряемое свойство допускает линейный континуум. Это не готовая анкета и не «таблица правильных баллов», а процедура конструирования измерителя.
Что измеряет шкала Терстоуна
Шкала измеряет латентную установку через словесные суждения. Например, тема может быть «отношение к дистанционному обучению», а полюса - от «дистанционный формат разрушает качество образования» до «дистанционный формат расширяет доступ к образованию». Респонденту показывают отобранные утверждения и просят отметить те, с которыми он согласен. Его шкальный балл получают по значениям выбранных суждений, а не по порядковым номерам вопросов.
Это важное отличие от шкалы Лайкерта. В Лайкерте каждый пункт обычно имеет одинаковый набор градаций согласия, а баллы ответов складывают или усредняют. В подходе Терстоуна разные утверждения заранее получают координаты на континууме благодаря оценкам судей. Поэтому разница между пунктами 2 и 3 должна интерпретироваться как такой же шаг, как между пунктами 7 и 8, если процедура действительно дала интервальную шкалу.
Шкала не измеряет «истину» о респонденте. Она кодирует выраженную в ответе установку в рамках конкретного набора формулировок. Если утверждения односторонние, непонятные или относятся к разным конструктам, точное число не спасёт исследование.

Метод равнокажущихся интервалов и судьи
Слово «равнокажущихся» указывает на источник шкальных значений. Судьи не сообщают, согласны ли они с утверждением лично. Они оценивают, какую позицию на воображаемой оси выражает фраза. Исследователь заранее задаёт, например, 11 категорий: 1 означает крайне отрицательное отношение, 11 - крайне положительное, 6 - нейтральное.
Для каждого утверждения собирают оценки нескольких независимых судей. Затем рассчитывают центральное значение, обычно медиану, и разброс ответов. Медиана становится предварительным шкальным значением фразы. Малый разброс означает, что судьи примерно одинаково поняли смысл суждения; большой - что оно двусмысленно, эмоционально перегружено или допускает разные трактовки.
В классической процедуре полезны и крайние группы судей: если оценки сосредоточены около одной категории, формулировка хорошо различает позицию на континууме. Если одна часть судей ставит её в начало, а другая - в конец, утверждение лучше переписать или исключить. Так эксперты калибруют стимулы, а не выступают выборкой респондентов.
Как отобрать исходные утверждения
Начните с определения одного конструкта. Если вы измеряете отношение к обязательной вакцинации, не смешивайте в одном банке суждения о доверии к врачам, личном опыте побочных эффектов и доступности поликлиник. Эти темы могут быть связаны, но не образуют одну очевидную ось.
Составьте длинный список коротких утверждений - от резко отрицательных через нейтральные к резко положительным. Фразы должны быть самостоятельными, без двойных отрицаний, жаргона и двух идей в одном предложении. Полезно сохранять утверждения разной интенсивности: мягкое «мера иногда оправданна» и жёсткое «мера недопустима в любых обстоятельствах» не должны случайно попасть в одну точку.
До работы судей удалите повторы и фразы, которые требуют специальных знаний. Проверьте, что каждая формулировка сообщает именно отношение, а не факт, который можно проверить отдельно. Для операционализации понятия запишите определение конструкта, полюса, целевую аудиторию и правило обработки пропусков.
Как получить шкальные значения
Предположим, 20 судей оценили 30 утверждений по 11 категориям. Для каждого пункта вы получаете ряд из 20 чисел. Медиана - его центральная позиция, а интерквартильный размах - расстояние между 25-м и 75-м процентилями. В учебной работе можно описать правило так: «Шкальным значением считалась медиана оценок судей, а пункты с большим разбросом исключались».
Важно не выдавать медиану за объективное измерение физического расстояния. Интервальность здесь основана на допущении: судьи воспринимают соседние категории как примерно равные шаги. Если разброс по пункту мал, это допущение выглядит правдоподобнее, но не становится доказанным законом природы.
После сортировки по медиане выберите набор пунктов, покрывающий весь диапазон. Не нужно оставлять десять почти одинаковых формулировок в центре. Лучше взять несколько хорошо разведённых утверждений и отдельно проверить, не потеряли ли вы содержательные грани конструкта.

Как проходит опрос респондентов
Респондент видит короткий список отобранных утверждений в перемешанном порядке. Перемешивание снижает влияние очевидной последовательности от отрицательного к положительному. Его просят отметить все фразы, которые лучше всего описывают его позицию, либо выбрать одну наиболее близкую - конкретное правило должно быть прописано заранее.
Если отмечено несколько суждений, простой итоговый балл можно получить как медиану их шкальных значений. Например, при выбранных позициях 3, 5 и 8 балл равен 5. Если отмечена одна фраза, её значение и есть результат. У респондента, который не отметил ни одного пункта, должен быть отдельный код пропуска, а не искусственный ноль.
Ключевой этап - пилотирование. Посмотрите, есть ли ответы во всём диапазоне, не выбирают ли участники почти всегда одну фразу и не возникает ли много пропусков. Для надёжности полезно повторить измерение на части выборки, а внутреннюю согласованность рассматривать осторожно: альфа Кронбаха предполагает определённую структуру пунктов и не проверяет качество шкальных значений судей.
Мини-пример шкалы отношения
Пусть тема - отношение к обязательному волонтёрству студентов. После сортировки судьи дали четырём утверждениям такие медианные значения:
| Утверждение | Шкальное значение |
|---|---|
| «Обязательное волонтёрство недопустимо» | 2,0 |
| «Участие должно быть добровольным, но поощряться» | 5,0 |
| «Для диплома полезно требовать общественный проект» | 7,0 |
| «Каждый студент обязан отработать часы на пользу города» | 9,0 |
Респондент отметил второе и третье утверждения. Его учебный балл - медиана 5,0 и 7,0, то есть 6,0. Это позиция между умеренной поддержкой и более требовательным вариантом. Нельзя говорить, что он «на 6 из 11 согласен»: число обозначает место выбранных суждений на построенной шкале, а не долю согласия.
Такой пример синтетический. В реальном исследовании нужно сообщить, кто были судьи, сколько их было, как формулировались инструкции, какие пункты исключили и по какому критерию. Аналогично при построении социологического индекса правила объединения должны быть видны читателю, а не спрятаны за итоговым числом.
Ограничения и отличие от других шкал
Главный недостаток - дорогая предварительная процедура. Нужны банк суждений, независимые судьи, инструкции и анализ разброса. Результат зависит от языка, контекста и состава экспертной группы. Шкала, откалиброванная для одной аудитории, не обязательно сохраняет те же значения в другой.
Второе ограничение - субъективность интервалов. Метод стремится к интервальной шкале, но равенство шагов подтверждается восприятием судей, а не физическим эталоном. Третье - риск потери содержания: несколько компактных пунктов могут выглядеть статистически аккуратно, но не охватить все стороны отношения.
Не смешивайте этот метод со шкалой Гуттмана. Гуттман строит кумулятивную лестницу: согласие с трудным пунктом должно подразумевать согласие с более лёгкими. Терстоун располагает суждения по интенсивности установки и не требует такой логики включения. Лайкерт, Гуттман и Терстоун - разные конструкции, даже если во всех используются слова и баллы.
Частые ошибки
- Судьи оценивают собственное согласие, а не смысл и интенсивность фразы. В итоге калибруется их мнение, а не положение утверждения на оси.
- Медиану считают доказательством точного интервала. Это только выбранное правило агрегации и допущение о равных шагах.
- В список включают утверждения о разных объектах: доверии, поведении и доступности услуги. Итоговый балл теряет однозначное толкование.
- Респондента заставляют выбрать «нейтральный» вариант, хотя он не знаком с темой. Лучше предусмотреть отдельный пропуск или «не могу оценить».
- Шкальные значения сравнивают между исследованиями без проверки формулировок, судей и культурного контекста.
Частые вопросы
Сколько судей нужно для шкалы Терстоуна?
Универсального магического числа нет: важнее независимость, понятная инструкция и анализ разброса. В учебном проекте нужно обосновать размер группы и показать распределения оценок, а не ограничиться фразой «эксперты проверили».
Можно ли использовать шкалу Терстоуна онлайн?
Да. Онлайн-форма подходит и для калибровки суждений, и для опроса, если инструкции и порядок заданий контролируются. Но цифровой формат не устраняет эффекты невнимательности, самовыбора и различий в понимании формулировок.
Нужна ли альфа Кронбаха?
Она может быть дополнительным описанием согласованности ответов на выбранные пункты, но не заменяет проверку содержания, разброса судей и валидности. Отчитывайте её вместе с логикой построения шкалы, а не как единственное доказательство качества.
Коротко
Шкала Терстоуна строится в два слоя: судьи сначала размещают утверждения на континууме интенсивности, затем респонденты выбирают подходящие суждения. Медианы и разброс помогают отобрать пункты, а итоговый балл получают из их шкальных значений. Метод полезен для аккуратного измерения установок, но требует прозрачной калибровки и не отменяет проверки валидности.
Читайте также

Исследование бюджета времени: методика и результаты
Исследование бюджета времени показывает, как люди распределяют сутки между работой, домашними делами, сном и досугом. Разбираем дневник, категории и гендерный разрыв.

Законы подражания Тарда: как возникает общество
Законы подражания Тарда: идеи и желания, логические и внелогические законы, роль изобретения, мода, социальное влияние и спор с Дюркгеймом в истории социологии.

Альфа Кронбаха: смысл, пороги и отчёт
Альфа Кронбаха показывает внутреннюю согласованность шкалы: разберём смысл коэффициента, пороги 0,70 и 0,85, влияние числа пунктов, ограничения, омегу и запись в курсовой.

Постиндустриальное общество Белла: 5 измерений
Постиндустриальное общество Даниела Белла: книга 1973 года, пять измерений перехода к услугам, роль теоретического знания, профессиональный класс и критика.

Социологическое воображение Миллса: личное и общее
Социологическое воображение Чарльза Райта Миллса: как связать личные трудности с общественными проблемами, биографию с историей и исследование с интеллектуальным ремеслом.

Индивидуализация Бека: три измерения и биография рисков
Индивидуализация по Ульриху Беку простыми словами: три измерения процесса, лифт-эффект, биография по выбору, институционализированный индивидуализм, зомби-категории и критика.