галлюцинации распознавания внутренние представления надёжность
arXiv cs.CL

The Anatomy of an ASR Hallucination

arXiv:2609.04404

Авторы разбирают, где в Conformer-распознавателе возникает расхождение между звуком и текстом при сдвиге условий. Последние блоки оказываются хрупкой точкой: они резко уменьшают эффективный ранг представления и делают графемы почти линейно читаемыми, но сама эта перестройка ещё не равна смысловой галлюцинации.

Метод. Исследуются независимые CTC- и RNN-T-модели примерно по 120 млн параметров на WildASR с семью видами сдвига и L2-Arctic. Авторы пропускают отдельные блоки, измеряют изменение расшифровки, эффективный ранг и точность линейного графемного пробника. Содержательность ошибок оценивается отдельно.

Результаты. Пропуск последнего блока меняет выход в 94–99 процентных пунктах случаев у CTC и в 42–88 у RNN-T, тогда как пропуск средних блоков меняет не более 8,5 пункта. Эффективный ранг в конце падает на 18–44%, а точность графемного пробника растёт с 0,81 до 0,99. Но простой признак расхождения даёт лишь 1 истинную смысловую галлюцинацию из 185 срабатываний у CTC и 8 из 116 у RNN-T.

Ограничения. Проверены только две английские модели и один тип вмешательства — пропуск блока. Смысловую классификацию помогает делать LLM без полноценной человеческой разметки. Однородные пакеты могут создавать побочный эффект состава данных, что авторы показывают отдельной перестановкой.

Фишка из статьи. Сильное причинное вмешательство почти никогда не создаёт правдоподобную выдумку — чаще оно порождает мусор или повторение.

МодельИзменение выхода при пропуске последнего блокаТипичный результатСвободная смысловая выдумка
CTC94–99 п.п.87% искажённый текст0 из 354 вмешательств
RNN-T42–88 п.п.98% повторения0 из 354 вмешательств

Как это читать: последний блок явно управляет решением, но его поломка не воспроизводит обычную галлюцинацию. Значит, «высокая чувствительность слоя» нельзя автоматически использовать как детектор правдоподобных выдумок.

Оригинальная статья на arXiv