АватарыВидеоМузыка и звук

daVinci-MagiHuman

Генерирует видео с говорящим человеком сразу со звуком: один трансформер обрабатывает текст, видео и аудио. Речь на 7 языках, русского в списке нет. Есть дистиллированные быстрые версии.

Разработчик
SII-GAIR и Sand.ai, Китай
Первый выпуск
мар 2026
Последний выпуск
мар 2026
Размеры
15B
Лицензия
Можно в коммерциюApache 2.0
Русский язык
Нет
Запуск
Через свой серверНужна видеокарта
Сферы
Маркетинг и контент, Медиа и продакшн, Образование

Какие задачи решает

  • Видео с ведущим по сценарию
  • Рекламные ролики с говорящим персонажем
  • Обучающие видео с диктором

Где применяется

Маркетинг и SMMОнлайн-обучениеВидеопродакшн

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
нет версий
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. daVinci-MagiHuman (Base, Distill, 256p–1080p)

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели