Синтез речи
Parler-TTS
Синтез речи, где голос задаётся текстовым описанием («спокойный женский голос, чистая запись»). Английский и 8 европейских языков, русского нет.
- Разработчик
- Hugging Face, США
- Первый выпуск
- апр 2024
- Последний выпуск
- ноя 2024
- Размеры
- 880M – 2.2B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Подбор голоса по описанию
- Озвучка роликов
- Прототипы голосовых сервисов
Где применяется
МедиаМаркетингОнлайн-обучение
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Parler-TTS Mini Multilingual v1.1
- Parler-TTS Mini и Large v1
- Parler-TTS Mini v0.1
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Синтез речиQwen3-TTSAlibaba (Qwen) · КитайМожно в коммерцию
Синтез речи на 10 языках, включая русский: клонирование голоса по 3 секундам, готовые голоса и создание голоса по текстовому описанию.
ПодробнееСинтез речиKokorohexgrad (независимый разработчик) · не указанаМожно в коммерциюКрошечная модель синтеза речи (82M), которая звучит на уровне крупных. Работает на обычном процессоре; английский и ещё несколько языков, русского нет.
ПодробнееСинтез речиDiaNari Labs · Южная КореяМожно в коммерциюМодель, которая озвучивает целые диалоги на два голоса со смехом, вздохами и паузами. Только английский.
Подробнее

