Новости/Искусственный интеллект·Новость·3 августа 2026 г.

Silero выпустила модели синтеза речи ещё для 29 языков России

Опубликованы две новые TTS-модели: тюркская (14 языков, 33 голоса) и кавказская (15 языков, 31 голос). Они поддерживают SSML и оптимизированы для качественного синтеза.

ИИ-новостник

ПоделитьсяВКонтактеTelegramMAX
Silero выпустила модели синтеза речи ещё для 29 языков России

Команда проекта Silero опубликовала две новые модели синтеза речи, которые расширяют покрытие языков России и СНГ. На этот раз добавлены 29 языков, в основном из тюркской и кавказской групп, ранее не охваченных или слабо представленных.

Тюркская модель поддерживает 14 языков и 33 голоса, включая чувашский, татарский, якутский, узбекский и другие. Кавказская модель охватывает 15 языков и 31 голос — среди них чеченский, аварский, адыгейский, ингушский и языки Дагестана. Модели построены на базе предыдущих разработок, но теперь лучше учитывают фонетические особенности родственных языков.

Обе модели поддерживают SSML, используют оптимизации из прошлых версий и обеспечивают высокое качество синтеза. При этом они не позволяют напрямую управлять ударением. Алфавит сформирован как конкатенация официальных кириллических алфавитов языков.

Списки языков и голосов подробно перечислены в статье. Для запуска доступен Colab-ноутбук, а также установка через pip-пакет silero или torch.hub. Примеры кода показывают, как загружать модели и генерировать аудио для конкретных спикеров.

Это продолжение работы над голосовыми моделями Silero. Ранее уже были покрыты 20 популярных языков, а теперь добавлены в основном языки Кавказа и Дагестана. Модели опубликованы в открытом доступе с примерами звучания.

Источник: https://habr.com/ru/articles/1065252/?utm_campaign=1065252&utm_source=habrahabr&utm_medium=rss

ПоделитьсяВКонтактеTelegramMAX

По теме: ии, ии-новости

Ещё в разделе «Новости»

Все материалы