Голос: спикеры и звук
Seed-VC
Конверсия голоса без обучения: переносит тембр по образцу в 1–30 секунд, умеет петь и работать в реальном времени, V2 меняет и акцент. Использовать только с согласия владельца голоса.
- Разработчик
- Songting Liu (Plachtaa), Китай
- Первый выпуск
- сен 2024
- Последний выпуск
- апр 2025
- Размеры
- около 70M – 200M
- Лицензия
- Коммерция с условиямиGPL-3.0: коммерция возможна, но изменённый код при распространении нужно открывать
Какие задачи решает
- Переозвучка ролика другим голосом
- Анонимизация голоса в записях
- Голос в реальном времени для стримов
Где применяется
Медиа и продакшнРазвлечения и стримингСлужбы, где нужно скрыть голос
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Seed-VC V2 (голос и акцент)
- Seed-VC v1.0 (с пением и реальным временем)
- Seed-VC v0.1–v0.3
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Голос: спикеры и звукRVC (Retrieval-based Voice Conversion)Сообщество RVC-Project · КитайМожно в коммерцию
Самый массовый открытый инструмент конверсии голоса: модель под конкретный голос учится за 10–30 минут записи, работает в реальном времени. Использовать только с согласия владельца голоса.
ПодробнееГолос: спикеры и звукOpenVoiceMyShell и MIT · СШАМожно в коммерциюМгновенное клонирование голоса по короткому образцу с управлением эмоцией и акцентом, V2 говорит на нескольких языках. Использовать только с согласия владельца голоса.
Подробнее

