SSL Anti-spoofing (wav2vec 2.0 + AASIST)
Развитие AASIST: вместо сырого звука берётся речевой энкодер wav2vec 2.0, из-за чего модель лучше держится на незнакомых способах синтеза. Ошибается в обе стороны — итог проверяет человек.
Последняя открытая версия вышла в сен 2023. Семейство давно не обновлялось: это не значит, что модель не работает, но свежих исправлений и новых размеров ждать не стоит.
- Разработчик
- EURECOM, Франция
- Первый выпуск
- апр 2022
- Последний выпуск
- сен 2023
- Размеры
- около 0,3B (энкодер wav2vec 2.0 XLS-R)
- Лицензия
- Можно в коммерциюMIT
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Безопасность, Финансы, Поддержка клиентов
Какие задачи решает
- Обнаружение синтезированной речи в звонках
- Проверка голосовых сообщений и записей
- Дообучение под свои данные и кодеки
- Сравнение с более простыми детекторами
Где применяется
Требования к железу
Версии
- Обновления весов и кода
- SSL Anti-spoofing (статья и код)
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать SSL Anti-spoofing (wav2vec 2.0 + AASIST) в коммерческом проекте?
Да. Лицензия: MIT. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для SSL Anti-spoofing (wav2vec 2.0 + AASIST)?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли SSL Anti-spoofing (wav2vec 2.0 + AASIST) русский язык?
Для этой модели язык не важен: она работает не с текстом.
Где скачать SSL Anti-spoofing (wav2vec 2.0 + AASIST) и сколько это стоит?
Веса SSL Anti-spoofing (wav2vec 2.0 + AASIST) лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Базовая открытая модель против подмены голоса: слушает сырую запись и отличает живого человека от синтеза и записи. Ошибается в обе стороны — её вывод повод для проверки человеком, а не доказательство.
ПодробнееДетекция подделокAntiDeepfake (NII)National Institute of Informatics, Yamagishi Lab · ЯпонияТолько некоммерческоеСемь речевых энкодеров (wav2vec 2.0, XLS-R, MMS, HuBERT), дообученных различать живую и синтезированную речь. Разработчики сами отмечают: качество сильно зависит от набора данных, вывод проверяет человек.
ПодробнееГолос: спикеры и звукWeSpeakerСообщество WeNet · КитайМожно в коммерциюНабор готовых моделей «голосового отпечатка»: сравнивает, один ли человек говорит в двух записях, и помогает делить запись по спикерам. Одна из моделей встроена в pyannote 3.x.
ПодробнееИсточник: github.com/TakHemlata/SSL_Anti-spoofing. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


