Синтез речи
Qwen3-TTS
Синтез речи на 10 языках, включая русский: клонирование голоса по 3 секундам, готовые голоса и создание голоса по текстовому описанию.
- Разработчик
- Alibaba (Qwen), Китай
- Первый выпуск
- янв 2026
- Последний выпуск
- янв 2026
- Размеры
- 0.6B – 1.7B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Голос для бота и ассистента
- Клонирование фирменного голоса
- Подбор голоса по описанию
- Озвучка роликов
Где применяется
Колл-центрыМедиа и маркетингОнлайн-обучениеГолосовые боты
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Qwen3-TTS 0.6B и 1.7B (Base, CustomVoice, VoiceDesign)
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Синтез речиCosyVoice / Fun-CosyVoiceAlibaba (Tongyi, FunAudioLLM) · КитайМожно в коммерцию
Синтез речи с клонированием голоса по короткому образцу и потоковой выдачей для живого диалога. Третья версия поддерживает 9 языков, включая русский.
ПодробнееСинтез речиVoxCPMOpenBMB (ModelBest, Университет Цинхуа) · КитайМожно в коммерциюСинтез речи с клонированием голоса и естественной интонацией. VoxCPM2 поддерживает 30 языков, включая русский.
ПодробнееСинтез речиChatterboxResemble AI · СШАМожно в коммерциюСинтез речи с клонированием голоса и настройкой эмоциональности. Многоязычная версия поддерживает 23 языка, включая русский; Turbo и Flash ускорены для живого диалога.
Подробнее

