Синтез речи
MOSS-TTS / MOSS-TTSD
Семейство синтеза речи: озвучка диалогов на несколько голосов (TTSD), быстрый синтез для живого общения и крошечная Nano. Версия 1.5 поддерживает 30+ языков, включая русский.
- Разработчик
- OpenMOSS (Фуданьский университет), Китай
- Первый выпуск
- июн 2025
- Последний выпуск
- май 2026
- Размеры
- 100M – 8.5B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Озвучка подкастов и диалогов
- Голос для ассистента
- Клонирование голоса
- Многоязычная озвучка
Где применяется
Медиа и подкастыОнлайн-обучениеГолосовые боты
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- MOSS-TTS v1.5
- MOSS-TTS Nano 100M
- MOSS-TTS, TTSD v1.0 и Realtime
- MOSS-TTSD v0.7
- MOSS-TTSD v0
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Синтез речиDiaNari Labs · Южная КореяМожно в коммерцию
Модель, которая озвучивает целые диалоги на два голоса со смехом, вздохами и паузами. Только английский.
ПодробнееРечь в текстVibeVoiceMicrosoft · СШАМожно в коммерциюРечевые модели Microsoft: синтез длинных диалогов на несколько голосов, быстрый синтез для живого общения и распознавание длинных записей с разделением по говорящим, в том числе на русском.
ПодробнееСинтез речиHiggs AudioBoson AI · СШАКоммерция с условиямиВыразительный синтез речи и диалогов с клонированием голоса, плюс модели распознавания. Третья версия синтеза поддерживает около 100 языков, включая русский, но некоммерческая.
Подробнее

