Аватары
MuseTalk
Синхронизация губ в реальном времени: подгоняет рот на видео под новое аудио. Подходит для перевода видео и живых аватаров.
- Разработчик
- Tencent Music (Lyra Lab), Китай
- Первый выпуск
- апр 2024
- Последний выпуск
- мар 2025
- Размеры
- меньше 1B
- Лицензия
- Можно в коммерциюMIT (код), веса разрешены для любых целей, включая коммерцию
Какие задачи решает
- Дубляж видео на другой язык
- Живой аватар в видеочате
- Правка речи в готовом ролике
Где применяется
ОбразованиеМедиаПоддержка клиентов
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- MuseTalk 1.5
- MuseTalk 1.0
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
АватарыLivePortraitKuaishou (Kling) · КитайМожно в коммерцию
Оживляет портрет по видео-образцу: мимика и повороты головы переносятся с актёра на фото. Быстро работает даже на слабой видеокарте.
ПодробнееАватарыMultiTalk / InfiniteTalkMeituan · КитайМожно в коммерциюДубляж и говорящие персонажи на базе Wan: MultiTalk ведёт диалог нескольких людей, InfiniteTalk переозвучивает видео любой длины с мимикой и телом.
ПодробнееАватарыSadTalkerСианьский университет Цзяотун и Tencent AI Lab · КитайМожно в коммерциюСтарая лёгкая модель говорящей головы: одно фото и аудио превращаются в видео. Работает на слабом железе, но качество заметно ниже новых.
Подробнее

