Институт прикладной семиотики Академии наук Татарстана подготовил массив данных для внедрения татарского языка в голосовые модули умных колонок. Об этом сообщает «Татар-информ» со ссылкой на директора института Рината Гильмуллина.

Фото: KazanFirst
Специалисты института записали и собрали более трех терабайт аудиоданных, пригодных для обучения голосовых ассистентов, включая сервис «Гигачат». В текстовом формате нейросеть уже умеет отвечать на запросы и переводить тексты на татарский язык.
По словам Рината Гильмуллина, институт уже заключил соглашения о сотрудничестве с компаниями-разработчиками. Сама база данных готова, и дальнейшая интеграция зависит от производителей устройств.