Синтез речи
Fish Speech / OpenAudio
Синтез речи с клонированием голоса и управлением эмоциями на 80+ языках, включая русский. Качество близко к платным сервисам, но веса только для исследований.
- Разработчик
- Fish Audio, США / Китай
- Первый выпуск
- апр 2024
- Последний выпуск
- мар 2026
- Размеры
- 0.5B – около 4.5B
- Лицензия
- Только некоммерческоеРанние версии CC BY-NC-SA 4.0, S2-Pro — Fish Audio Research License; коммерция только по отдельному договору
Какие задачи решает
- Клонирование голоса
- Эмоциональная озвучка
- Озвучка на многих языках
Где применяется
ИсследованияМедиаРазработка прототипов
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Fish Audio S2-Pro
- OpenAudio S1-mini
- Fish Speech 1.5
- Fish Speech 1.0
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Синтез речиCosyVoice / Fun-CosyVoiceAlibaba (Tongyi, FunAudioLLM) · КитайМожно в коммерцию
Синтез речи с клонированием голоса по короткому образцу и потоковой выдачей для живого диалога. Третья версия поддерживает 9 языков, включая русский.
ПодробнееСинтез речиIndexTTSbilibili · КитайКоммерция с условиямиСинтез речи с клонированием голоса и точным контролем длительности, удобен для дубляжа видео. Управляет эмоциями отдельно от тембра.
ПодробнееСинтез речиQwen3-TTSAlibaba (Qwen) · КитайМожно в коммерциюСинтез речи на 10 языках, включая русский: клонирование голоса по 3 секундам, готовые голоса и создание голоса по текстовому описанию.
Подробнее

