Видео2025–2026
Alibaba · Китай
Генерация видео по тексту и по картинке. Младшая версия запускается на игровой видеокарте. После 2.2 базовые модели открыто не выходят, только прикладные: монтаж (VACE), говорящие персонажи по звуку (S2V), танцы под музыку (Dancer).
- Короткие рекламные ролики
- Оживление фото товара
- Видео для соцсетей
- Размеры
- 1,3B – 14B
- Железо
- от: 1 видеокарта
АватарыGGUF2025–2026
Meituan · Китай
Говорящие люди по аудио на базе LongCat-Video. Версия 1.5 доведена до продакшна: стабильные длинные ролики на китайском и английском.
- Видео с ведущим новостей или курса
- Промо-ролики с говорящим персонажем
- Пение и озвучка
- Размеры
- на базе LongCat-Video 13.6B
- Железо
- от: 1 видеокарта
Аватары2024–2026
Фуданьский университет · Китай
Серия говорящих портретов по аудио: от коротких клипов до часовых видео в 4K. Hallo-Live рассчитана на работу в реальном времени.
- Видео с ведущим по фото и аудио
- Длинные обучающие ролики
- Живой аватар
- Размеры
- около 1B – 5B
- Железо
- от: 1 видеокарта
Аватары2026
SII-GAIR и Sand.ai · Китай
Генерирует видео с говорящим человеком сразу со звуком: один трансформер обрабатывает текст, видео и аудио. Речь на 7 языках, русского в списке нет. Есть дистиллированные быстрые версии.
- Видео с ведущим по сценарию
- Рекламные ролики с говорящим персонажем
- Обучающие видео с диктором
- Размеры
- 15B
- Железо
- от: 1 видеокарта
ВидеоGGUF2025–2026
Skywork AI (Kunlun Tech) · Китай
Видеомодели для кинематографичных сцен с людьми. Умеют ролики неограниченной длины, продление видео и говорящих персонажей по аудио.
- Длинные ролики с продолжением
- Видео с одним персонажем по референсу
- Говорящий аватар по голосу
- Размеры
- 1.3B – 19B
- Железо
- от: 1 видеокарта
Аватары2024–2026
Ant Group · Китай
Говорящие аватары от Ant Group: лицо, а с V2 и жесты рук. V3-Flash выдаёт видео за 8 шагов и укладывается в 12 ГБ видеопамяти.
- Видео с ведущим по фото и голосу
- Аватар с жестами для презентаций
- Озвученные персонажи
- Размеры
- до 1.3B
- Железо
- от: 1 видеокарта
АватарыGGUF2025–2026
Alibaba (Quark) · Китай
Потоковый аватар в реальном времени неограниченной длины. Подходит для живых эфиров и диалога, но требует мощного серверного железа.
- Живой аватар для диалога с клиентом
- Бесконечные трансляции с ведущим
- Интерактивные персонажи
- Размеры
- 14B
- Железо
- от: 1 видеокарта
Аватары2025
Meituan · Китай
Дубляж и говорящие персонажи на базе Wan: MultiTalk ведёт диалог нескольких людей, InfiniteTalk переозвучивает видео любой длины с мимикой и телом.
- Дубляж видео с подгонкой мимики
- Диалог двух персонажей по аудио
- Длинные ролики с ведущим
- Размеры
- 14B
- Железо
- от: 1 видеокарта
Аватары2025
ByteDance · Китай
Подгоняет движения губ на готовом видео под новую озвучку. Версия 1.6 работает в 512 пикселей и даёт более чёткое лицо.
- Переозвучка роликов на другой язык с попаданием в губы
- Правка реплик в готовом видео без пересъёмки
- Говорящие аватары для обучающих курсов
- Размеры
- нужно 8–18 ГБ видеопамяти
- Железо
- от: Ноутбук
АватарыGGUF2025
Tencent · Китай
Говорящие персонажи на базе HunyuanVideo: передаёт эмоции голоса, работает с несколькими персонажами и разными стилями.
- Видео с ведущим по фото и аудио
- Сцены с несколькими говорящими
- Мультяшные персонажи
- Размеры
- около 13B
- Железо
- от: 1 видеокарта
Аватары2024–2025
Tencent Music (Lyra Lab) · Китай
Синхронизация губ в реальном времени: подгоняет рот на видео под новое аудио. Подходит для перевода видео и живых аватаров.
- Дубляж видео на другой язык
- Живой аватар в видеочате
- Правка речи в готовом ролике
- Размеры
- меньше 1B
- Железо
- от: Ноутбук
АватарыНе развивается2024
Kuaishou (Kling) · Китай
Оживляет портрет по видео-образцу: мимика и повороты головы переносятся с актёра на фото. Быстро работает даже на слабой видеокарте.
- Оживление портретов
- Перенос мимики актёра на персонажа
- Анимация маскотов
- Размеры
- меньше 1B
- Железо
- от: Ноутбук
АватарыНе развивается2023
Сианьский университет Цзяотун и Tencent AI Lab · Китай
Старая лёгкая модель говорящей головы: одно фото и аудио превращаются в видео. Работает на слабом железе, но качество заметно ниже новых.
- Говорящее фото для приветствия
- Простые озвученные аватары
- Размеры
- меньше 1B
- Железо
- от: Ноутбук
АватарыНе развивается2020
IIIT Hyderabad · Индия
Классическая модель синхронизации губ с аудио, до сих пор популярна в любительских сборках. Губы точные, но картинка лица размытая, лицензия некоммерческая.
- Быстрые пробы переозвучки
- Сравнение с новыми lip-sync моделями
- Учебные и исследовательские проекты
- Размеры
- малая модель, лицо 96 пикселей
- Железо
- от: Ноутбук