AntiDeepfake (NII)
Семь речевых энкодеров (wav2vec 2.0, XLS-R, MMS, HuBERT), дообученных различать живую и синтезированную речь. Разработчики сами отмечают: качество сильно зависит от набора данных, вывод проверяет человек.
- Разработчик
- National Institute of Informatics, Yamagishi Lab, Япония
- Первый выпуск
- май 2025
- Последний выпуск
- окт 2025
- Размеры
- 0,3B – 2B
- Лицензия
- Только некоммерческоеCC BY-NC-SA 4.0 — исследования и обучение, коммерческое использование запрещено
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Безопасность, Финансы, Медиа и продакшн, Наука
Какие задачи решает
- Проверка аудиозаписей на синтез
- Дообучение под свой язык и канал записи
- Сравнение нескольких энкодеров на своих данных
- Исследования по устойчивости детекции
Где применяется
Требования к железу
Версии
- Обновление карточек и весов
- MMS-300M, MMS-1B, HuBERT-XL
- XLS-R-1B и XLS-R-2B
- wav2vec-small и wav2vec-large anti-deepfake
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать AntiDeepfake (NII) в коммерческом проекте?
Нет. Лицензия: CC BY-NC-SA 4.0 — исследования и обучение, коммерческое использование запрещено. Для коммерческого продукта нужна другая модель или отдельное соглашение с правообладателем.
Какое железо нужно для AntiDeepfake (NII)?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли AntiDeepfake (NII) русский язык?
Для этой модели язык не важен: она работает не с текстом.
Где скачать AntiDeepfake (NII) и сколько это стоит?
Веса AntiDeepfake (NII) лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Базовая открытая модель против подмены голоса: слушает сырую запись и отличает живого человека от синтеза и записи. Ошибается в обе стороны — её вывод повод для проверки человеком, а не доказательство.
ПодробнееДетекция подделокSSL Anti-spoofing (wav2vec 2.0 + AASIST)EURECOM · ФранцияМожно в коммерциюРазвитие AASIST: вместо сырого звука берётся речевой энкодер wav2vec 2.0, из-за чего модель лучше держится на незнакомых способах синтеза. Ошибается в обе стороны — итог проверяет человек.
ПодробнееГолос: спикеры и звукWeSpeakerСообщество WeNet · КитайМожно в коммерциюНабор готовых моделей «голосового отпечатка»: сравнивает, один ли человек говорит в двух записях, и помогает делить запись по спикерам. Одна из моделей встроена в pyannote 3.x.
ПодробнееИсточник: huggingface.co/nii-yamagishilab/wav2vec-large-anti-deepfake. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


