Открытые нейросети для говорящих аватаров

Модели аватаров оживляют портрет и синхронизируют движения губ с аудио, чтобы получить видео с говорящим ведущим. Это ускоряет выпуск обучающих роликов, презентаций и рекламы. Учитывайте лицензию, требования к видеокарте и права на использование лица и голоса конкретного человека.

В подборке 14 семейств открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
Видео2025–2026

Wan

Alibaba · Китай

Генерация видео по тексту и по картинке. Младшая версия запускается на игровой видеокарте. После 2.2 базовые модели открыто не выходят, только прикладные: монтаж (VACE), говорящие персонажи по звуку (S2V), танцы под музыку (Dancer).

  • Короткие рекламные ролики
  • Оживление фото товара
  • Видео для соцсетей
Размеры
1,3B – 14B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
АватарыGGUF2025–2026

LongCat-Video-Avatar

Meituan · Китай

Говорящие люди по аудио на базе LongCat-Video. Версия 1.5 доведена до продакшна: стабильные длинные ролики на китайском и английском.

  • Видео с ведущим новостей или курса
  • Промо-ролики с говорящим персонажем
  • Пение и озвучка
Размеры
на базе LongCat-Video 13.6B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Аватары2024–2026

Hallo

Фуданьский университет · Китай

Серия говорящих портретов по аудио: от коротких клипов до часовых видео в 4K. Hallo-Live рассчитана на работу в реальном времени.

  • Видео с ведущим по фото и аудио
  • Длинные обучающие ролики
  • Живой аватар
Размеры
около 1B – 5B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Аватары2026

daVinci-MagiHuman

SII-GAIR и Sand.ai · Китай

Генерирует видео с говорящим человеком сразу со звуком: один трансформер обрабатывает текст, видео и аудио. Речь на 7 языках, русского в списке нет. Есть дистиллированные быстрые версии.

  • Видео с ведущим по сценарию
  • Рекламные ролики с говорящим персонажем
  • Обучающие видео с диктором
Размеры
15B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ВидеоGGUF2025–2026

SkyReels

Skywork AI (Kunlun Tech) · Китай

Видеомодели для кинематографичных сцен с людьми. Умеют ролики неограниченной длины, продление видео и говорящих персонажей по аудио.

  • Длинные ролики с продолжением
  • Видео с одним персонажем по референсу
  • Говорящий аватар по голосу
Размеры
1.3B – 19B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Аватары2024–2026

EchoMimic

Ant Group · Китай

Говорящие аватары от Ant Group: лицо, а с V2 и жесты рук. V3-Flash выдаёт видео за 8 шагов и укладывается в 12 ГБ видеопамяти.

  • Видео с ведущим по фото и голосу
  • Аватар с жестами для презентаций
  • Озвученные персонажи
Размеры
до 1.3B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
АватарыGGUF2025–2026

Live Avatar

Alibaba (Quark) · Китай

Потоковый аватар в реальном времени неограниченной длины. Подходит для живых эфиров и диалога, но требует мощного серверного железа.

  • Живой аватар для диалога с клиентом
  • Бесконечные трансляции с ведущим
  • Интерактивные персонажи
Размеры
14B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Аватары2025

MultiTalk / InfiniteTalk

Meituan · Китай

Дубляж и говорящие персонажи на базе Wan: MultiTalk ведёт диалог нескольких людей, InfiniteTalk переозвучивает видео любой длины с мимикой и телом.

  • Дубляж видео с подгонкой мимики
  • Диалог двух персонажей по аудио
  • Длинные ролики с ведущим
Размеры
14B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Аватары2025

LatentSync

ByteDance · Китай

Подгоняет движения губ на готовом видео под новую озвучку. Версия 1.6 работает в 512 пикселей и даёт более чёткое лицо.

  • Переозвучка роликов на другой язык с попаданием в губы
  • Правка реплик в готовом видео без пересъёмки
  • Говорящие аватары для обучающих курсов
Размеры
нужно 8–18 ГБ видеопамяти
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
АватарыGGUF2025

HunyuanVideo-Avatar

Tencent · Китай

Говорящие персонажи на базе HunyuanVideo: передаёт эмоции голоса, работает с несколькими персонажами и разными стилями.

  • Видео с ведущим по фото и аудио
  • Сцены с несколькими говорящими
  • Мультяшные персонажи
Размеры
около 13B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Аватары2024–2025

MuseTalk

Tencent Music (Lyra Lab) · Китай

Синхронизация губ в реальном времени: подгоняет рот на видео под новое аудио. Подходит для перевода видео и живых аватаров.

  • Дубляж видео на другой язык
  • Живой аватар в видеочате
  • Правка речи в готовом ролике
Размеры
меньше 1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
АватарыНе развивается2024

LivePortrait

Kuaishou (Kling) · Китай

Оживляет портрет по видео-образцу: мимика и повороты головы переносятся с актёра на фото. Быстро работает даже на слабой видеокарте.

  • Оживление портретов
  • Перенос мимики актёра на персонажа
  • Анимация маскотов
Размеры
меньше 1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
АватарыНе развивается2023

SadTalker

Сианьский университет Цзяотун и Tencent AI Lab · Китай

Старая лёгкая модель говорящей головы: одно фото и аудио превращаются в видео. Работает на слабом железе, но качество заметно ниже новых.

  • Говорящее фото для приветствия
  • Простые озвученные аватары
Размеры
меньше 1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
АватарыНе развивается2020

Wav2Lip

IIIT Hyderabad · Индия

Классическая модель синхронизации губ с аудио, до сих пор популярна в любительских сборках. Губы точные, но картинка лица размытая, лицензия некоммерческая.

  • Быстрые пробы переозвучки
  • Сравнение с новыми lip-sync моделями
  • Учебные и исследовательские проекты
Размеры
малая модель, лицо 96 пикселей
Железо
от: Ноутбук
Только некоммерческоеПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение