Аватары

SadTalker

Старая лёгкая модель говорящей головы: одно фото и аудио превращаются в видео. Работает на слабом железе, но качество заметно ниже новых.

Разработчик
Сианьский университет Цзяотун и Tencent AI Lab, Китай
Первый выпуск
апр 2023
Последний выпуск
июл 2023
Размеры
меньше 1B
Лицензия
Можно в коммерциюApache 2.0 (код), MIT на карточке HF

Какие задачи решает

  • Говорящее фото для приветствия
  • Простые озвученные аватары

Где применяется

ОбразованиеSMM

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. SadTalker V0.0.2
  2. SadTalker

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели