YAMNet
Крошечная модель на 521 звуковое событие, включая сигнализацию, разбитое стекло и крик: помещается на микроконтроллер и работает без видеокарты. Микрофон может записать голоса людей — это персональные данные, порядок согласуйте с юристом.
- Разработчик
- Google, США
- Первый выпуск
- ноя 2019
- Последний выпуск
- сен 2026
- Размеры
- 3,7M
- Лицензия
- Можно в коммерциюApache 2.0
- Готовые сборки
- 8 бит
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Безопасность, Производство и склад, Разработка ПО, Медиа и продакшн
Какие задачи решает
- Быстрая разметка звука прямо на устройстве
- Детекция тревожных звуков на объекте
- Отбор интересных фрагментов из непрерывной записи
- Основа для своего классификатора по нескольким классам
Где применяется
Требования к железу
Версии
- Обновление сборки Qualcomm AI Hub
- Сборка для мобильных и встраиваемых устройств (Qualcomm AI Hub)
- YAMNet в репозитории TensorFlow Models
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам. Квантование — сжатие модели: она занимает меньше видеопамяти и работает на более скромном железе. Отвечает при этом чуть иначе, поэтому качество проверяют на своих примерах.
Частые вопросы
Можно ли использовать YAMNet в коммерческом проекте?
Да. Лицензия: Apache 2.0. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для YAMNet?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли YAMNet русский язык?
Для этой модели язык не важен: она работает не с текстом.
Где скачать YAMNet и сколько это стоит?
Веса YAMNet лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Классический набор свёрточных сетей для разметки звука по 527 категориям AudioSet: от шума механизма и сигнализации до разбитого стекла и крика. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет. Микрофон может записать и голоса людей — это персональные данные, порядок согласуйте с юристом.
ПодробнееДиагностика по звукуCEDXiaomi · КитайМожно в коммерциюКомпактные модели разметки звука: от 5,5M до 86M, есть сборки ONNX и INT8, работают на обычном процессоре и на плате рядом с оборудованием. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
ПодробнееМузыка и звукAST (Audio Spectrogram Transformer)MIT · СШАМожно в коммерциюКлассическая модель 2021 года для распознавания звуков: определяет 527 классов событий AudioSet (сирена, лай, стекло, музыка). Лёгкая, работает без видеокарты, с 2022 года в Transformers.
ПодробнееИсточник: huggingface.co/qualcomm/YamNet. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


