Кыргызский язык: потоковое распознавание и длинные записи
В Speech Expert появилось потоковое распознавание кыргызской речи. Предварительный текст поступает по мере речи, а после завершения каждой фразы приходит уточнённый окончательный результат. Возможность доступна в живых субтитрах, при потоковой обработке длинных файлов и через API.
Читать текст, пока запись продолжается
В основном кабинете выберите язык «Кыргызча» и откройте «Живые субтитры». Текст текущей фразы будет обновляться по мере распознавания. Предварительная формулировка может измениться; для сохранения и дальнейшей работы используйте окончательные фразы.
Обработка следующей фразы продолжается, пока уточняется предыдущая. Интерфейс сохраняет новый предварительный текст при получении более раннего финала — уже появившиеся слова следующей фразы не исчезают.
Длинный файл без предварительной нарезки
Для готовой записи выберите «Длинный файл · потоково» и кыргызский язык. Файл передаётся частями, а расшифровка появляется во время обработки. Интерфейс отдельно показывает загрузку файла и обработанную длительность. Обычная загрузка готовых файлов также остаётся доступной.
Теперь потоковая обработка длинных файлов и потоковый API поддерживают шесть языков: русский, английский, казахский, кыргызский, узбекский и таджикский. Для кыргызского возвращаются временные границы аудиофрагментов, включая паузы; пословные таймкоды не предоставляются.
Подключение через API
Кыргызский поток доступен через WebSocket и gRPC. Приложение одновременно отправляет звук и получает предварительные и окончательные результаты. В документации описаны настройки языка, сопоставление фраз и корректное завершение сеанса.
При обработке длинного файла оставьте вкладку открытой до сообщения о завершении и сохраните нужный результат. Закрытие вкладки останавливает сеанс; автоматического продолжения с места обрыва нет.
Как включить потоковое распознавание · Руководство по работе с записями