PANNs
Классический набор свёрточных сетей для разметки звука по 527 категориям AudioSet: от шума механизма и сигнализации до разбитого стекла и крика. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет. Микрофон может записать и голоса людей — это персональные данные, порядок согласуйте с юристом.
- Разработчик
- University of Surrey, Великобритания
- Первый выпуск
- дек 2019
- Последний выпуск
- июн 2026
- Размеры
- от 5,9M (CNN6) до 81,9M (CNN14)
- Лицензия
- Можно в коммерциюMIT
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Производство и склад, Безопасность, Медиа и продакшн, Наука
Какие задачи решает
- Разметка того, что происходит на записи с микрофона
- Детекция сигнализации, разбитого стекла, крика
- Основа для своей модели под звуки конкретного цеха
- Разбор архива записей с камер и датчиков
Где применяется
Требования к железу
Версии
- Сборка CNN14 для мобильных устройств (LiteRT)
- Зеркала на Hugging Face в формате safetensors
- PANNs, первые веса CNN6, CNN10, CNN14 и другие
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать PANNs в коммерческом проекте?
Да. Лицензия: MIT. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для PANNs?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли PANNs русский язык?
Для этой модели язык не важен: она работает не с текстом.
Где скачать PANNs и сколько это стоит?
Веса PANNs лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Классическая модель 2021 года для распознавания звуков: определяет 527 классов событий AudioSet (сирена, лай, стекло, музыка). Лёгкая, работает без видеокарты, с 2022 года в Transformers.
ПодробнееДиагностика по звукуCEDXiaomi · КитайМожно в коммерциюКомпактные модели разметки звука: от 5,5M до 86M, есть сборки ONNX и INT8, работают на обычном процессоре и на плате рядом с оборудованием. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
ПодробнееДиагностика по звукуYAMNetGoogle · СШАМожно в коммерциюКрошечная модель на 521 звуковое событие, включая сигнализацию, разбитое стекло и крик: помещается на микроконтроллер и работает без видеокарты. Микрофон может записать голоса людей — это персональные данные, порядок согласуйте с юристом.
ПодробнееИсточник: huggingface.co/nicofarr/panns_Cnn14. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


