EssayAI
Блог
Блог
Гуманитарные науки

Шкала Гуттмана: скалограмма и коэффициент воспроизводимости

22 сентября 2026Время чтения: 11 минут
#шкала Гуттмана#скалограммный анализ#коэффициент воспроизводимости#кумулятивная шкала#методы социологии
Шкала Гуттмана: скалограмма и коэффициент воспроизводимости

Шкала Гуттмана устроена как лестница: суждения выстроены от самого лёгкого к самому трудному, и человек, согласный с трудным, по модели согласен со всеми более лёгкими. Поэтому по одному числу, баллу респондента, можно восстановить весь его набор ответов. Но это обещание модели, а не свойство любой анкеты: кумулятивность нужно проверить на реальных данных. Проверку называют скалограммным анализом, и её итог сводится к двум коэффициентам. Посчитать их для своей таблицы можно в калькуляторе ниже, а дальше разберём, откуда они берутся.

Что такое шкала Гуттмана

Шкала Гуттмана, или кумулятивная шкала, это набор дихотомических суждений («да/нет», «согласен/не согласен»), упорядоченных по трудности. Трудность здесь означает, насколько сильно должно быть выражено свойство, чтобы человек ответил «да». Сказать «слежу за новостями города» легко почти любому, а «организовал местную инициативу» скажет только очень активный горожанин.

Из порядка следует ключевое понятие: идеальный профиль ответов. Если суждения пронумерованы от лёгкого к трудному, допустимы только профили вида «да на первые ss пунктов, нет на остальные». Для пяти суждений из 25=322^5 = 32 возможных комбинаций модели соответствуют всего шесть: 00000, 10000, 11000, 11100, 11110 и 11111. Балл ss от 0 до 5 однозначно указывает, какие именно пункты приняты. В шкале Лайкерта сумма 3 может получиться десятком способов, здесь только одним.

Вертикальная стойка с планками на разной высоте: всё ниже уровня респондента пройдено, всё выше не пройдено
Вертикальная стойка с планками на разной высоте: всё ниже уровня респондента пройдено, всё выше не пройдено

Удобная метафора: прыжок в высоту. У каждого суждения своя высота планки, у каждого респондента своя высота прыжка. Кто взял планку на 150 см, взял и все ниже. Этот же принцип заложен в шкалу социальной дистанции: подробный разбор её семи ступеней есть в статье про шкалу Богардуса, которую считают историческим прообразом гуттмановской конструкции.

Луис Гуттман и «Американский солдат»

Луис Гуттман (1916-1987), американский социолог и статистик, изложил идею в статье «A Basis for Scaling Qualitative Data» (American Sociological Review, 1944). Практическую проверку она прошла в годы Второй мировой войны в исследовательском отделе армии США, которым руководил Сэмюэл Стауффер. Отдел опросил сотни тысяч военнослужащих о боевом духе, страхе, отношении к службе и командирам. Итоги вышли в серии «Американский солдат» (The American Soldier, 1949-1950), а методологический том «Measurement and Prediction» (1950) почти целиком посвящён скалограммному анализу.

Задача была прикладной: военным нужны были короткие анкеты, по которым можно сравнивать подразделения. Гуттман предложил не складывать ответы механически, а сначала проверить, выстраиваются ли вопросы в одну лестницу. Классический пример из этих материалов: солдаты, сообщавшие о тяжёлых проявлениях страха в бою, почти всегда отмечали и более частые, лёгкие реакции вроде учащённого сердцебиения. Такой набор симптомов вёл себя как кумулятивная шкала.

Скалограммный анализ: как построить шкалу по шагам

Скалограммой называют таблицу «респонденты × суждения», переставленную так, чтобы проявилась лестница. Построение идёт в семь шагов.

  1. Определите одно измерение. Шкала Гуттмана одномерна по определению. Сначала понятие проходит операционализацию, и из его измерений выбирается одно.
  2. Составьте 8-12 суждений разной трудности. В итоговой шкале обычно остаётся 4-7 пунктов, поэтому кандидатов берут с запасом. Каждое суждение должно описывать ступень того же свойства.
  3. Дихотомизируйте ответы. Если вопрос с пятью вариантами, заранее решите, что считать «да» (например, «скорее согласен» и «полностью согласен»).
  4. Проведите пилотный опрос и занесите ответы в таблицу нулей и единиц.
  5. Упорядочите столбцы по числу ответов «да»: слева самое популярное суждение, справа самое редкое.
  6. Упорядочите строки по баллу респондента: сверху те, у кого больше всего «да».
  7. Посчитайте ошибки и коэффициенты, уберите пункты, которые дают больше всего ошибок, и пересчитайте.
Скалограмма: закрашенные ответы образуют лестницу, клетка за её границей отмечена как ошибка
Скалограмма: закрашенные ответы образуют лестницу, клетка за её границей отмечена как ошибка

В идеальной скалограмме единицы образуют ровный треугольник-лестницу в левом верхнем углу. Каждая единица за границей лестницы и каждый ноль внутри неё означают отклонение от модели.

Сквозной пример: 5 суждений и 10 респондентов

Измеряем гражданскую активность студентов пятью суждениями, уже упорядоченными по трудности:

  • А. Слежу за новостями своего города.
  • Б. Подписывал(а) онлайн-петицию или коллективное обращение.
  • В. Приходил(а) на собрание жильцов или публичные слушания.
  • Г. Писал(а) обращение депутату или в администрацию.
  • Д. Участвовал(а) в организации местной инициативы.

Ответы десяти респондентов после сортировки:

РеспондентАБВГДБалл ssИдеальный профильОшибки
Р1111115111110
Р2111104111100
Р3111104111100
Р4111003111000
Р5111003111000
Р6110103111002
Р7110002110000
Р8101002110002
Р9100001100000
Р10000000000000
Ответов «да»976414

Ошибки считаем по методу Гуденафа и Эдвардса: для каждого респондента берём идеальный профиль с тем же баллом и сравниваем клетку за клеткой. У Р6 балл 3, идеал 11100, а фактически 11010: расходятся столбцы В и Г, две ошибки. У Р8 балл 2, идеал 11000, фактически 10100: расходятся Б и В, тоже две. Остальные восемь профилей идеальны. Всего E=4E = 4 ошибки на 10×5=5010 \times 5 = 50 ответов.

Коэффициент воспроизводимости: формула и порог 0,90

Коэффициент воспроизводимости показывает, какую долю ответов можно точно восстановить по баллу респондента:

CR=1−En⋅kCR = 1 - \frac{E}{n \cdot k}

где EE - число ошибок, nn - число респондентов, kk - число суждений. Для примера:

CR=1−410⋅5=1−0,08=0,92CR = 1 - \frac{4}{10 \cdot 5} = 1 - 0{,}08 = 0{,}92

Гуттман предложил считать набор шкалой при CR≥0,90CR \ge 0{,}90, то есть когда не больше 10% ответов расходятся с моделью. Наш результат 0,92 проходит порог с небольшим запасом: при 50 ответах допустимо не больше 5 ошибок, а шестая уже опустила бы CRCR до 0,88.

Способ подсчёта ошибок надо указывать в работе. В исходном варианте Гуттмана ошибкой считают минимальное число клеток, которые надо исправить, чтобы профиль стал идеальным. Тогда у Р6 и Р8 будет по одной ошибке, E = 2 и CR = 0,96. Метод Гуденафа и Эдвардса строже, он засчитывает каждую перестановку как две ошибки.

Коэффициент масштабируемости: защита от лёгких пунктов

У CRCR есть слабость: он завышается, если суждения слишком лёгкие или слишком трудные. Пункт, с которым согласны 9 из 10, почти не может дать много ошибок, даже если ответы на него случайны. Чтобы отделить заслугу шкалы от заслуги маргиналов, Херберт Мензель в 1953 году предложил коэффициент масштабируемости.

Сначала считают минимальную маргинальную воспроизводимость: сколько ответов угадал бы тот, кто по каждому пункту ставит самый частый ответ:

MMR=∑j=1kmax⁡(pj, n−pj)n⋅kMMR = \frac{\sum_{j=1}^{k} \max(p_j,\ n - p_j)}{n \cdot k}

где pjp_j - число ответов «да» на суждение jj. В примере по столбцам: max⁡(9,1)=9\max(9, 1) = 9, max⁡(7,3)=7\max(7, 3) = 7, max⁡(6,4)=6\max(6, 4) = 6, max⁡(4,6)=6\max(4, 6) = 6, max⁡(1,9)=9\max(1, 9) = 9. Сумма 37, значит MMR=37/50=0,74MMR = 37/50 = 0{,}74. Затем:

CS=CR−MMR1−MMR=0,92−0,741−0,74=0,180,26≈0,69CS = \frac{CR - MMR}{1 - MMR} = \frac{0{,}92 - 0{,}74}{1 - 0{,}74} = \frac{0{,}18}{0{,}26} \approx 0{,}69

Принятый порог около 0,60, так что шкала проходит и вторую проверку. Но картина скромнее, чем показывал CRCR: из 92% воспроизведённых ответов 74% дали бы одни маргиналы, сама лестница добавляет меньше. Если бы пункты А и Д заменили на суждения средней трудности, MMRMMR снизился бы, и та же доля ошибок сказалась бы на CSCS сильнее.

Ограничения и связь с моделью Раша

У шкалы Гуттмана четыре известных ограничения:

  • Одномерность. Если суждения задевают два свойства (например, активность и доверие к властям), лестница рассыпается.
  • Детерминизм. Модель не допускает случайности: любой сбой в ответах считается ошибкой, хотя реальные люди отвечают с шумом.
  • Мало пунктов. С ростом числа суждений ошибки накапливаются, поэтому рабочие шкалы редко длиннее 7-8 пунктов, а короткую шкалу трудно сделать чувствительной.
  • Зависимость от выборки. Лестница, найденная у студентов, может не воспроизвестись у пенсионеров: порядок трудности пунктов не гарантирован для другой совокупности.

Ответом на детерминизм стали вероятностные модели. В модели Раша (1960) вероятность ответа «да» плавно зависит от разницы между уровнем респондента θi\theta_i и трудностью суждения bjb_j:

P(xij=1)=eθi−bj1+eθi−bjP(x_{ij} = 1) = \frac{e^{\theta_i - b_j}}{1 + e^{\theta_i - b_j}}

Шкала Гуттмана получается из неё как предельный случай, когда кривая превращается в ступеньку: при θi>bj\theta_i > b_j ответ «да» с вероятностью 1, иначе «нет». Непараметрическую версию той же идеи даёт шкалирование Мокена с коэффициентом Левинджер HH. Для курсовой обычно достаточно классического CRCR и CSCS, но упомянуть вероятностные модели в разделе об ограничениях полезно.

Частые ошибки

  • Называть шкалой Гуттмана любой набор вопросов с суммарным баллом. Без скалограммы и CRCR это просто индекс; различие подробно разобрано в статье про социологический индекс.
  • Приводить CRCR без CSCS. Высокая воспроизводимость на очень лёгких и очень трудных пунктах почти ничего не доказывает.
  • Не указывать способ подсчёта ошибок. По Гуттману и по Гуденафу и Эдвардсу одна таблица даёт разные CRCR.
  • Упорядочивать суждения по замыслу автора, а не по фактическим долям «да» в данных.
  • Проверять шкалу на 10-20 анкетах и переносить вывод на генеральную совокупность. Учебный пример иллюстрирует расчёт, для реальной шкалы нужна выборка в сотни человек.

FAQ

Чем шкала Гуттмана отличается от шкалы Лайкерта?

Лайкерт суммирует степень согласия с независимыми утверждениями, и одинаковый балл может получиться из разных ответов. У Гуттмана пункты образуют лестницу, и балл однозначно задаёт профиль. Поэтому для Лайкерта проверяют внутреннюю согласованность, а для Гуттмана воспроизводимость порядка.

Сколько суждений нужно для шкалы Гуттмана?

В итоговой шкале обычно 4-7 суждений. На этапе пилота берут 8-12 кандидатов и отсеивают те, что дают больше всего ошибок. Меньше четырёх пунктов делают CRCR почти автоматически высоким, больше восьми редко удаётся удержать в одной лестнице. Требования к формулировкам пунктов общие для любой анкеты, их удобно сверить с правилами анкетирования.

Что делать, если CR ниже 0,90?

Найдите суждения, на которые приходится больше всего ошибок, и проверьте формулировки: двусмысленный пункт или пункт про другое свойство ломает лестницу. Удалите или перепишите его и пересчитайте. Если после чистки CRCR всё равно ниже порога, набор честнее описывать как индекс.

Коротко

Шкала Гуттмана это кумулятивный набор суждений, упорядоченных по трудности, где балл респондента однозначно восстанавливает его ответы. Идею Луис Гуттман развил в 1940-е годы в проекте «Американский солдат» под руководством Стауффера. Проверка идёт через скалограмму: столбцы сортируют по доле «да», строки по баллу, считают отклонения от идеальных профилей. Коэффициент воспроизводимости CR=1−E/(nk)CR = 1 - E/(nk) должен быть не ниже 0,90, коэффициент масштабируемости CSCS не ниже 0,60; в нашем примере с 4 ошибками на 50 ответов вышло 0,92 и 0,69. Ограничения модели (одномерность, детерминизм, короткие шкалы) снимают вероятностные подходы вроде модели Раша.

Доверьте текст нейросети EssayAI

Открыть EssayAI

Бесплатно, на русском языке и без VPN

Читайте также

Метод фокус-групп: как провести исследование

Метод фокус-групп: как провести исследование

Метод фокус-групп в социологии и маркетинге: состав участников, роль модератора, гайд беседы, запись и тематический анализ. Отличия от интервью, ошибки и пример исследования.

28 сентября 20268 минут
Социологический эксперимент: метод и дизайн

Социологический эксперимент: метод и дизайн

Социологический эксперимент: как устроены гипотеза, группы и воздействие, чем отличаются лабораторный, полевой и естественный дизайн, как оценить валидность и этику.

28 сентября 20268 минут
Контент-анализ в социологии: от категорий до каппы Коэна

Контент-анализ в социологии: от категорий до каппы Коэна

Контент-анализ в социологии по шагам: определение Берельсона, единицы анализа и счёта, кодировочный бланк, качественный вариант и проверка надёжности через каппу Коэна.

10 сентября 20269 минут
Анкетирование: правила составления анкеты

Анкетирование: правила составления анкеты

Анкетирование и правила составления анкеты: структура из трёх частей, типы вопросов, правило воронки, шкалы Лайкерта и семантического дифференциала, пилотаж и разбор типичных ошибок формулировок.

8 сентября 202610 минут
Квотная выборка: как построить квотное задание

Квотная выборка: как построить квотное задание

Квотная выборка: как выбрать признаки и рассчитать ячейки квотного задания, чем маргинальные квоты отличаются от связанных, почему это неслучайный отбор и какие смещения он даёт.

3 сентября 20269 минут
Панельное исследование: одни и те же люди по волнам

Панельное исследование: одни и те же люди по волнам

Панельное исследование в социологии: чем отличается от трендового и когортного, как устроены волны и панельная матрица, что такое истощение панели и панельный эффект, как описать дизайн.

2 сентября 20269 минут