Ijtimoiy-gumanitar fanlar

O‘ZBEK TILI SHEVALARINI AVTOMATIK NUTQNI ANIQLASH (ASR) TIZIMLARIDA TANIB OLISH SAMARADORLIGI TAHLILI

автоматическое распознавание речи, ASR, Speech-to-Text, диалекты узбекского языка, Word Error Rate (WER), Whisper Large, Kotib STT, диалектный корпус, fine-tuning.

Авторы

  • Xurmatoy MULLABOYEVA Magistrant, Toshkent davlat o‘zbek tili va adabiyoti universiteti, Toshkent, O‘zbekiston, Узбекистан

В статье исследовано влияние диалектного разнообразия узбекского языка на точность систем автоматического распознавания речи (ASR). Сравнительный статистический анализ моделей (Kotib STT, OmoN STT, Rubai STT и Whisper Large) на базе аудиоматериалов карлукской, кыпчакской и огузской групп показал, что точность распознавания падает с 90–95% (для литературной нормы) до 25–30% в вариативных диалектах. Выявлено, что основные лексические ошибки вызваны аффиксальной редукцией и чередованием гласных. Для решения проблемы научно обоснована необходимость расширения многодиалектных акустико-лингвистических корпусов и регионального дообучения (fine-tuning) моделей.