Партнёрство
Все проекты
Речевые технологии2026

Распознавание каракалпакской речи

Модель перевода каракалпакской речи в текст. Доля ошибок в словах пока не дотягивает до релизного качества, поэтому мы откладываем запуск и исправляем данные, вместо того чтобы выпустить модель, которая недослышит людей.

02 / Speech · research
В исследованииНе выпущено
34%
Текущий WER
15%
Цель для релиза
38h
Обучающие данные
2026
Начат
О проекте
ПартнёрИсследование центра
СтатусВ исследовании
КомандаРечевая команда центра
Стек
PyTorchASR architecturesData collectionEvaluation with native speakers

Задача

Для малоресурсного языка распознавание сложнее синтеза: нужны много дикторов, много условий записи и много диалектных вариантов. Наша текущая доля ошибок слишком высока для задач, к которым модель применили бы сразу, — расшифровки совещаний, обращений и публичных документов.

Наш подход

01

Диагностировать, а не латать

Анализ ошибок по дикторам, диалектам и условиям записи вместо погони за одной цифрой бенчмарка.

02

Расширять корпус там, где модель ошибается

Целевая запись тех групп дикторов и тех условий, с которыми модель справляется хуже всего.

03

Выпустить, когда будет честно

Модель войдёт в API karakalpakvoice.uz только тогда, когда уровень ошибок станет достаточно низким для реальной расшифровки.

Примечание

Мы предпочитаем выпустить позже, чем выпустить модель, которая недослышит язык. Эта страница будет обновлена, когда уровень ошибок станет достойным релиза.

Другие проекты