Синтез речи

OmniVoice

Синтез речи с клонированием голоса по короткому образцу на 646 языках, включая русский и языки народов России. Можно описать голос словами. Веса только для некоммерческого использования.

Разработчик
k2-fsa (Next-gen Kaldi), Китай
Первый выпуск
мар 2026
Последний выпуск
мар 2026
Размеры
0.6B
Лицензия
Только некоммерческоеКод Apache 2.0, веса CC BY-NC (некоммерческие из-за обучающих данных)
Русский язык
Есть
Запуск
Через свой серверНужна видеокарта
Сферы
Медиа и продакшн, Образование, Наука

Какие задачи решает

  • Озвучка на редких языках
  • Клонирование голоса по образцу
  • Исследования и прототипы многоязычной озвучки

Где применяется

ИсследованияОбразованиеМедиа (некоммерческие проекты)

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. OmniVoice

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели