Голос: спикеры и звук

TEN VAD

Лёгкий детектор речи для голосовых ассистентов в реальном времени: быстрее замечает начало и конец фразы, чем Silero VAD. Работает на сервере, телефоне и в браузере.

Разработчик
Agora (проект TEN), США / Китай
Первый выпуск
май 2025
Последний выпуск
июл 2025
Размеры
очень малая, библиотека меньше Silero VAD
Лицензия
Коммерция с условиямиApache 2.0 с дополнительными условиями: нельзя использовать в продуктах, конкурирующих с Agora, и давать третьим лицам строить на ней свои приложения
Запуск
Через свой серверРаботает и без видеокарты
Сферы
Поддержка клиентов, Разработка ПО

Какие задачи решает

  • Определение речи в голосовом боте без задержек
  • Быстрая реакция ассистента на конец фразы
  • Работа в мобильных приложениях и браузере

Где применяется

Голосовые ботыКолл-центрыРазработка продуктов

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. TEN VAD 1.0 и ONNX-версия
  2. TEN VAD

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели