пространственный слух HRTF маскировка в музыке
arXiv eess.AS

Effects of HRTF Augmentation on Predicted Spatial Release from Masking in Music

arXiv:2608.28422

Можно ли сделать межушные спектральные различия сильнее естественных, чтобы слушателю было проще отделить инструмент от музыкального фона? Авторы масштабируют главные компоненты индивидуальных HRTF и получают крупный прогнозируемый выигрыш для нормального слуха, но показывают, что при тугоухости большая часть этого выигрыша становится неслышимой.

Метод. Музыкальные цели и маскирующие инструменты размещаются в диотическом режиме, по простым ILD/ITD, с индивидуальной HRTF и с её усиленными вариантами до HRTF4.0. Пространственное освобождение от маскировки SRM рассчитывают две модели слуха: речевая vicente2020 и bischof2023 для сложных тонов. Отдельно моделируются нормальный профиль N0, умеренная нейросенсорная потеря N3 и N3 после широкополосной динамической компрессии слухового аппарата.

Результаты. Для фронтальной цели естественная HRTF даёт 6,97 дБ SRM, а HRTF4.0 — 10,31 дБ. В среднем по положениям усиление HRTF добавляет 3,08 дБ при N0: это рост лучшего межушного отношения сигнал/помеха на 3,35 дБ при потере 0,27 дБ бинаурального подавления. При N3 средний SRM падает с 9,37 до 7,60 дБ, а выигрыш усиления сокращается до 1,05 дБ. Компрессия улучшает общую слышимость с −6,84 до −2,76 дБ эффективного отношения, но не возвращает эффект усиленной HRTF.

Ограничения. Это только расчёт слуховых моделей, без поведенческого опыта. Модели созданы для речи и сложных тонов и не учитывают музыкальную структуру, обучение необычным пространственным признакам, расширение слуховых фильтров и ухудшение временной тонкой структуры. Усиленная HRTF может улучшать расчётное отношение сигнал/помеха, но одновременно искажать локализацию.

Фишка из статьи. Слуховой аппарат восстанавливает слышимость, но почти не восстанавливает дополнительную пользу HRTF4.0. Более того, независимая компрессия двух ушей искажает кратковременный ILD в среднем на 2,87 дБ, а большее искажение связано с большим падением SRM.

ПрофильВыигрыш HRTF4.0 над естественной HRTFИнтерпретация
N0, нормальный слух+3,08 дБВысокочастотные ILD доступны
N3, без аппарата+1,05 дББольшая часть усиленных ILD ниже внутреннего порога
N3 + WDRCоколо +1,06 дБИзменение к N3 всего +0,01 дБ, p=0,81

Как это читать: компрессия делает цель в целом слышнее, но не возвращает пространственную разницу между обычной и усиленной HRTF. Для практического алгоритма нужно совместно сохранять межушные признаки, а окончательный вывод потребует испытаний на слушателях.

Оригинальная статья на arXiv