Эффект коктейльной вечеринки: опыт Черри и модели

Эффект коктейльной вечеринки - способность выделять речь одного собеседника из общего гула, где одновременно говорят десятки людей, звенит посуда и играет музыка. Название в 1953 году дал британский инженер-акустик Колин Черри, и с тех пор эффект остаётся центральной моделью для изучения избирательного слухового внимания: он показывает и то, как психика отсекает лишнее, и то, что отсечённое всё же продолжает обрабатываться. Ниже - что именно измерял Черри, какие акустические признаки помогают слуху разделить голоса, чем спорят три классические модели отбора и почему собственное имя пробивается сквозь фильтр. Собрать точный ответ под свой вопрос поможет разбор сразу за введением.
Что такое эффект коктейльной вечеринки
Формально это избирательное слуховое внимание: слушатель настраивается на один источник речи среди множества конкурирующих и понимает его, хотя физически в ухо приходит смесь всех сигналов сразу. Отношение сигнал/шум в такой ситуации бывает нулевым и даже отрицательным, то есть посторонние голоса громче нужного, - и разборчивость всё равно сохраняется.
Черри разделил задачу на две части, и это разделение до сих пор задаёт логику исследований. Первая: как слух вообще ухитряется разложить единую звуковую волну на отдельные голоса и удержать один из них. Вторая, менее очевидная: что происходит с остальными - гаснут ли они полностью или продолжают обрабатываться в фоне. В инженерной литературе первая половина известна как cocktail party problem, задача разделения источников; в психологии обсуждают в основном вторую.
Опыт Черри: дихотическое слушание и вторение
Метод Черри прост и потому воспроизводим до сих пор. Испытуемому надевают наушники и подают в левое и правое ухо два разных речевых потока - это дихотическое слушание. Требуется вслух повторять текст только из одного уха, слово в слово с небольшой задержкой; такое повторение называют вторением, или шэдоуингом. Задача занимает внимание целиком и не даёт незаметно переключаться между каналами.

Результат оказался резким. Про игнорируемое ухо испытуемые уверенно сообщали только физические свойства сигнала: была там речь или чистый тон, мужской голос или женский, менялась ли громкость. Содержание не воспроизводилось вовсе. Более того, участники не замечали, что текст в фоновом канале переключался с английского на немецкий, а также не опознавали речь, пущенную задом наперёд. Зато собственное имя, вставленное в игнорируемый поток, часть слушателей ловила - и на этом противоречии выросла вся дальнейшая дискуссия.
Какие признаки помогают выделить голос
Слух опирается не на один признак, а на их совокупность; чем больше различий между голосами, тем легче удержать нужный.
- Пространственное разнесение. Звук от источника сбоку приходит в дальнее ухо позже и тише. Межушную задержку приближённо описывает формула Вудворта , где - радиус головы, - азимут источника, - скорость звука; максимум составляет около мкс. На высоких частотах голова даёт ещё и разницу по уровню.
- Высота основного тона. Различие всего в один-два полутона уже заметно улучшает разборчивость, потому что слух группирует гармоники, кратные одной частоте.
- Тембр и темп. Разные форманты и разный ритм речи не дают потокам слипнуться в один.
- Зрение. Видимая артикуляция собеседника добавляет к разборчивости эквивалент нескольких децибел.

Выигрыш от того, что мешающий голос разнесён с целевым в пространстве, называют пространственным освобождением от маскировки; он достигает - дБ. Именно поэтому запись с одного микрофона слушать тяжелее, чем ту же сцену вживую: моно лишает слух межушных различий, и эффект коктейльной вечеринки почти не работает.
Три модели отбора: Бродбент, Трейсман, Дойчи
Дальше психология спорила об одном: на какой стадии обработки происходит отсев.
Дональд Бродбент в 1958 году предложил модель ранней фильтрации. Информация от всех каналов попадает в кратковременный сенсорный буфер, затем фильтр по физическому признаку - ухо, высота голоса, направление - пропускает дальше только один канал, а остальное отбрасывается по принципу «всё или ничего». Модель хорошо объясняла данные Черри, но не объясняла имя, услышанное в отключённом канале.
Энн Трейсман в начале 1960-х заменила фильтр аттенюатором: игнорируемый канал не блокируется, а ослабляется. Слова в словаре имеют разные пороги узнавания, и у значимых единиц - собственного имени, слова «пожар», ожидаемого по контексту продолжения фразы - порог низкий, поэтому даже ослабленный сигнал их активирует.

Диана и Энтони Дойчи в 1963 году предложили радикальный вариант: анализируется всё, включая смысл, а отбор происходит поздно, уже на этапе выбора ответа и записи в память. Спор не решён окончательно, но с 1990-х его сняли компромиссом: по теории перцептивной нагрузки Нилли Лави стадия отбора плавает. При высокой нагрузке на восприятие ресурсов не хватает и отбор оказывается ранним, при низкой - лишний материал успевает пройти семантическую обработку. Это тот же принцип ограниченного ресурса, что и в теории когнитивной нагрузки Свеллера.
Эффект собственного имени
Ключевой факт получил Нил Морей в 1959 году: своё имя в игнорируемом канале замечали около трети испытуемых, тогда как обычные слова и даже прямые инструкции проходили мимо. Уильям Вуд и Нельсон Коуэн в 1995 году повторили опыт со строгим контролем и получили похожую долю - примерно 35 процентов.
Важнее оказалось объяснение различий. Эндрю Конвей с коллегами в 2001 году показал: имя ловят преимущественно люди с малым объёмом рабочей памяти - около 65 процентов против примерно 20 у людей с большим объёмом. Слабое торможение постороннего потока, а не острый слух: тот, кто хуже удерживает фокус, чаще пропускает в сознание фоновый материал.
На экзамене эффект собственного имени просят объяснить в терминах моделей. Корректный ответ: он опровергает жёсткий фильтр Бродбента и поддерживает аттенюатор Трейсман, поскольку сигнал в игнорируемом канале ослаблен, но не уничтожен, а порог узнавания собственного имени аномально низок.
Где эффект ломается
Первыми страдают пожилые люди и слушатели с сенсоневральной тугоухостью: разборчивость в тишине у них может оставаться приличной, а в шуме падает резко, потому что нарушено частотное разрешение и снижена чувствительность к межушным различиям. Похожие трудности описаны при расстройствах обработки слуховой информации, СДВГ и после черепно-мозговой травмы. Практическое следствие: жалоба «слышу, но не разбираю в компании» - показание к речевой аудиометрии в шуме, а не к простой тональной аудиограмме.
Инженерная сторона задачи решается отдельно. Разделением голосов занимаются алгоритмы слепого разделения источников, микрофонные решётки с формированием диаграммы направленности и нейросетевые модели, которые обучаются разносить речь по маскам в спектрограмме. Идея выделения релевантного из общей смеси весами напоминает механизм внимания attention в нейросетях, хотя биологического механизма он не копирует. Сам факт, что тема с 1950-х формулируется через внутренние ограничения обработки, а не через реакции, - примета когнитивной революции в психологии.
Частые ошибки
- Считать игнорируемый канал полностью отключённым. Данные Морея и Трейсман говорят об ослаблении, а не о выключении.
- Приписывать открытие Бродбенту. Эффект описал Черри в 1953 году; Бродбент в 1958-м предложил первую модель его объяснения.
- Сводить всё к громкости. Эффект работает и при отрицательном отношении сигнал/шум, ключ - в различиях по направлению, высоте и тембру.
- Путать дихотическое слушание с бинауральным. В дихотической схеме в уши подают разные сигналы, в бинауральной - согласованную пару от одного источника.
- Обобщать долю в треть. Она сильно зависит от объёма рабочей памяти испытуемого и условий опыта.
FAQ
Кто открыл эффект коктейльной вечеринки и когда? Колин Черри, статья в Journal of the Acoustical Society of America за 1953 год. Он же ввёл процедуру вторения и сформулировал задачу как двойную: удержать один голос и понять судьбу остальных.
Почему на записи разобрать собеседника труднее, чем вживую? Один микрофон сводит сцену в моно и стирает межушные различия по времени и уровню. Слух лишается главного признака для разделения источников, и пространственное освобождение от маскировки в - дБ исчезает.
Слышим ли мы то, что говорят в стороне от разговора? Частично. Физические свойства фонового потока фиксируются всегда, смысл - обычно нет, но значимые единицы вроде собственного имени прорываются, особенно при низкой нагрузке на восприятие и небольшом объёме рабочей памяти.
Коротко
Эффект коктейльной вечеринки - выделение одного речевого потока из смеси конкурирующих. Черри в 1953 году показал методом вторения, что про игнорируемое ухо остаются только физические характеристики сигнала, а содержание теряется. Слух опирается на межушные различия, высоту основного тона, тембр и видимую артикуляцию, выигрывая в шуме до - дБ от пространственного разнесения. Жёсткий фильтр Бродбента объясняет базовые данные, но эффект собственного имени требует аттенюатора Трейсман или позднего отбора Дойчей; современный компромисс - гибкая стадия отбора по перцептивной нагрузке.
Читайте также

Селективное внимание: модели отбора информации
Селективное внимание: ранняя фильтрация Бродбента, аттенюатор Трейсман, поздняя селекция Дойчей, данные дихотического слушания и теория перцептивной нагрузки Лави с разбором ошибок.

Эксперимент с невидимой гориллой Саймонса: суть и выводы
Эксперимент Саймонса и Шабри с невидимой гориллой 1999 года: что такое слепота невнимания, почему мы не замечаем очевидное и как этот феномен влияет на жизнь.

Адаптация первокурсников к вузу
Адаптация первокурсников к вузу: виды трудностей, этапы вхождения в учебную и социальную среду, роль куратора и тьютора, методы оценки и практические рекомендации.

Адвербиализация: как слова становятся наречиями
Адвербиализация в русском языке: переход существительных, прилагательных и деепричастий в наречия, критерии, спорные случаи и правила слитного написания.

Акт о супрематии 1534: церковь и власть
Акт о супрематии 1534 года: почему Генрих VIII стал главой церкви Англии, как присяга привела к казни Мора и Фишера, роспуску монастырей и появлению англиканства.

Александрийская поэзия: черты и представители
Александрийская поэзия эллинистической эпохи: Мусейон, Каллимах, Феокрит, эпиграмма и учёная работа со старой традицией, повлиявшая на римских поэтов.