Синтез речи
Bark
Одна из первых открытых моделей, которая озвучивает текст с интонациями, смехом и паузами. Поддерживает около десятка языков, включая русский. Сейчас устарела.
- Разработчик
- Suno, США
- Первый выпуск
- апр 2023
- Последний выпуск
- июл 2023
- Размеры
- около 300M – 1B
- Лицензия
- Можно в коммерциюMIT
Какие задачи решает
- Черновая озвучка роликов
- Прототипы голосовых сервисов
- Звуковые эффекты в речи
Где применяется
МедиаМаркетингРазработка прототипов
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Bark Small
- Bark
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Синтез речиCoqui XTTSCoqui · ГерманияТолько некоммерческое
Популярная модель клонирования голоса по короткому образцу на 17 языках, включая русский. Компания Coqui закрылась, развитие остановлено.
ПодробнееСинтез речиF5-TTSШанхайский университет Цзяотун и партнёры · КитайТолько некоммерческоеМодель клонирования голоса по нескольким секундам образца, английский и китайский. Сообщество выпустило много дообученных версий под другие языки, в том числе русский.
ПодробнееСинтез речиChatterboxResemble AI · СШАМожно в коммерциюСинтез речи с клонированием голоса и настройкой эмоциональности. Многоязычная версия поддерживает 23 языка, включая русский; Turbo и Flash ускорены для живого диалога.
Подробнее

