DASS
Модель разбора звука на пространстве состояний вместо трансформера: держит записи длиной в часы, что удобно для непрерывного прослушивания линии. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
- Разработчик
- MIT CSAIL и MIT-IBM Watson AI Lab, США
- Первый выпуск
- июл 2024
- Последний выпуск
- апр 2025
- Размеры
- 30M (small) и 49M (medium)
- Лицензия
- Можно в коммерциюBSD 3-Clause
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Производство и склад, Безопасность, Медиа и продакшн, Наука
Какие задачи решает
- Разбор длинных непрерывных записей
- Поиск редкого события в многочасовой смене
- Разметка звуковых событий на объекте
- Дообучение под свои звуки оборудования
Где применяется
Требования к железу
Версии
- Обновлённые веса small и medium
- Веса DASS small и medium на Hugging Face
- DASS, статья и код
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать DASS в коммерческом проекте?
Да. Лицензия: BSD 3-Clause. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для DASS?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли DASS русский язык?
Для этой модели язык не важен: она работает не с текстом.
Где скачать DASS и сколько это стоит?
Веса DASS лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Классическая модель 2021 года для распознавания звуков: определяет 527 классов событий AudioSet (сирена, лай, стекло, музыка). Лёгкая, работает без видеокарты, с 2022 года в Transformers.
ПодробнееДиагностика по звукуEATShanghai Jiao Tong University и Peng Cheng Laboratory · КитайМожно в коммерциюСамообучаемая модель разбора звука, которую заметно дешевле обучать под свои данные, чем предшественников. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
ПодробнееДиагностика по звукуCEDXiaomi · КитайМожно в коммерциюКомпактные модели разметки звука: от 5,5M до 86M, есть сборки ONNX и INT8, работают на обычном процессоре и на плате рядом с оборудованием. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
ПодробнееИсточник: huggingface.co/saurabhati/DASS_medium_AudioSet_50.2. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


