В России создали компактную ИИ-модель для определения языка по голосу

Российская компания «Криптонит» разработала модель, которая определяет язык речи по короткому аудиофрагменту. Разработчики заявляют, что она работает примерно в десять раз быстрее исходной системы при отклонении точности менее 1%.

Наука и технологии | В России создали компактную ИИ-модель для определения языка по голосу
Сгенерировано ИИ

Модель стала компактнее и быстрее

ИИ анализирует голосовой сигнал и выделяет акустические и фонетические особенности речи. На их основе система определяет, на каком языке говорит человек.

Модель содержит 219 млн параметров, тогда как исходная open-source-модель насчитывала около 1 млрд. Несмотря на значительно меньший размер, российская разработка обрабатывает данные примерно в десять раз быстрее.

В «Криптоните» не раскрывают название исходной модели, однако уточняют, что она не имеет китайского происхождения. Новая система была создана на ее основе с помощью дополнительного обучения.

Разработка снижает нагрузку на инфраструктуру

Компактная модель может оказаться полезной там, где приходится одновременно обрабатывать большое количество голосовых записей. В первую очередь речь идет о службах поддержки и телекоммуникационных компаниях, работающих с многомиллионными объемами аудиоданных.

По словам представителей «Криптонита», снижение требований к вычислительным ресурсам особенно актуально на фоне роста нагрузки на дата-центры и увеличения стоимости вычислений. Более легкая модель позволяет обрабатывать больше информации на уже существующей инфраструктуре без соответствующего наращивания количества серверов.

Для пользователя технология может работать практически незаметно: например, автоматически определять язык входящего голосового сообщения и помогать распределять аудиопотоки между соответствующими системами обработки.

Разработка российской компании также показывает, что для подобных задач необязательно использовать крупные модели с миллиардом параметров. Уменьшение размера системы позволяет сократить вычислительные затраты, сохранив близкую к исходной точность.

Таким образом, «Криптонит» представил более компактный инструмент для автоматического определения языка речи, ориентированный прежде всего на обработку больших объемов аудио. Потенциально это может упростить работу российских компаний с масштабными голосовыми потоками.

Источник: ТАСС

Комментарии

Обсуждение

Комментарии к записи хранятся в теме форума и отображаются здесь.

Обсуждение ещё не создано. Нажмите «Оставить комментарий», чтобы начать.
Обсудить на форуме
Присоединяйтесь к
обсуждению этой темы
с экспертами и читателями
Дайджест
Главные открытия недели в одном письме

Короткая подборка материалов, которые помогают не выпадать из научной и технологической повестки.

Читайте также
ИИ-помощник
Ответы генерируются автоматически
Здравствуйте. Я ИИ-помощник сайта. Напишите вопрос, и я постараюсь помочь.
Можно спросить:
Не отправляйте пароли, доступы и персональные данные.