Синтез речи
ESpeech-TTS
Русский синтез речи с клонированием голоса на архитектуре F5-TTS, обучен на собранных авторами наборах русской речи. Ударения расставляются автоматически. Несколько вариантов, в том числе «подкастер».
- Разработчик
- ESpeech (независимая группа русскоязычных разработчиков), Россия
- Первый выпуск
- авг 2025
- Последний выпуск
- авг 2025
- Размеры
- около 340M
- Лицензия
- Коммерция с условиямиApache 2.0 по карточке на HF; модель построена на архитектуре F5-TTS, официальные веса которой некоммерческие, — перед коммерческим запуском проверьте с юристом
- Русский язык
- Есть
- Запуск
- Через свой серверНужна видеокарта
- Сферы
- Медиа и продакшн, Поддержка клиентов, Образование
Какие задачи решает
- Озвучка роликов и аудиокниг на русском
- Клонирование голоса диктора по образцу
- Голос для бота или ассистента на русском
Где применяется
Медиа и контентГолосовые ботыОбразование
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- ESpeech-TTS-1 (SFT-95K, SFT-256K, RL-V1, RL-V2, podcaster)
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Синтез речиF5-TTSШанхайский университет Цзяотун и партнёры · КитайТолько некоммерческое
Модель клонирования голоса по нескольким секундам образца, английский и китайский. Сообщество выпустило много дообученных версий под другие языки, в том числе русский.
ПодробнееСинтез речиSilero TTSSilero · РоссияКоммерция с условиямиЛёгкий синтез русской речи, работает на обычном процессоре. Версия v5 добавила языки СНГ и народов России: татарский, башкирский, якутский, казахский и другие.
ПодробнееСинтез речиCoqui XTTSCoqui · ГерманияТолько некоммерческоеПопулярная модель клонирования голоса по короткому образцу на 17 языках, включая русский. Компания Coqui закрылась, развитие остановлено.
Подробнее

