Распознавание каракалпакской речи
Модель перевода каракалпакской речи в текст. Доля ошибок в словах пока не дотягивает до релизного качества, поэтому мы откладываем запуск и исправляем данные, вместо того чтобы выпустить модель, которая недослышит людей.
Задача
Для малоресурсного языка распознавание сложнее синтеза: нужны много дикторов, много условий записи и много диалектных вариантов. Наша текущая доля ошибок слишком высока для задач, к которым модель применили бы сразу, — расшифровки совещаний, обращений и публичных документов.
Наш подход
Диагностировать, а не латать
Анализ ошибок по дикторам, диалектам и условиям записи вместо погони за одной цифрой бенчмарка.
Расширять корпус там, где модель ошибается
Целевая запись тех групп дикторов и тех условий, с которыми модель справляется хуже всего.
Выпустить, когда будет честно
Модель войдёт в API karakalpakvoice.uz только тогда, когда уровень ошибок станет достаточно низким для реальной расшифровки.
Мы предпочитаем выпустить позже, чем выпустить модель, которая недослышит язык. Эта страница будет обновлена, когда уровень ошибок станет достойным релиза.