Dasheng
Универсальный кодировщик звука, обученный на 272 тысячах часов записей речи, музыки и шумов: даёт признаки, поверх которых учат свой классификатор нештатных звуков. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
- Разработчик
- Xiaomi, Китай
- Первый выпуск
- июн 2024
- Последний выпуск
- мар 2026
- Размеры
- 86M – 1.2B
- Лицензия
- Можно в коммерциюApache 2.0
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Производство и склад, Безопасность, Медиа и продакшн, Наука
Какие задачи решает
- Признаки звука для своей модели аномалий
- Поиск похожих фрагментов в архиве записей
- Дообучение под звуки конкретной линии
- Разметка звуковых событий на объекте
Где применяется
Требования к железу
Версии
- Шумоподавитель на базе Dasheng
- Dasheng-0.6B и Dasheng-1.2B
- Dasheng-Base
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать Dasheng в коммерческом проекте?
Да. Лицензия: Apache 2.0. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для Dasheng?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли Dasheng русский язык?
Для этой модели язык не важен: она работает не с текстом.
Где скачать Dasheng и сколько это стоит?
Веса Dasheng лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Компактные модели разметки звука: от 5,5M до 86M, есть сборки ONNX и INT8, работают на обычном процессоре и на плате рядом с оборудованием. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
ПодробнееДиагностика по звукуBEATsMicrosoft · СШАМожно в коммерциюСамообучаемая модель разбора звука, ставшая опорой для многих современных систем: её берут как основу и дообучают под свои звуки оборудования. Система не ставит диагноз, а даёт повод проверить узел раньше, чем он встанет.
ПодробнееМузыка и звукCLAP (LAION)LAION · ГерманияМожно в коммерциюАналог CLIP для звука: переводит аудио и текст в общее пространство. Можно искать звуки и музыку по описанию и классифицировать их без обучения. Текст — английский.
ПодробнееИсточник: huggingface.co/mispeech/dasheng-base. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


