Голос: спикеры и звук

Seed-VC

Конверсия голоса без обучения: переносит тембр по образцу в 1–30 секунд, умеет петь и работать в реальном времени, V2 меняет и акцент. Использовать только с согласия владельца голоса.

Разработчик
Songting Liu (Plachtaa), Китай
Первый выпуск
сен 2024
Последний выпуск
апр 2025
Размеры
около 70M – 200M
Лицензия
Коммерция с условиямиGPL-3.0: коммерция возможна, но изменённый код при распространении нужно открывать

Какие задачи решает

  • Переозвучка ролика другим голосом
  • Анонимизация голоса в записях
  • Голос в реальном времени для стримов

Где применяется

Медиа и продакшнРазвлечения и стримингСлужбы, где нужно скрыть голос

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Seed-VC V2 (голос и акцент)
  2. Seed-VC v1.0 (с пением и реальным временем)
  3. Seed-VC v0.1–v0.3

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели