Samsone
Крошечные модели понимания звука для смартфона: слушают речь, музыку и звуки вокруг и отвечают текстом — описывают запись и отвечают на вопросы о ней. Работают прямо на устройстве, вопросы и ответы — на английском: других языков в обучающих данных нет.
- Разработчик
- Samsung, Южная Корея
- Первый выпуск
- сен 2026
- Последний выпуск
- сен 2026
- Размеры
- 99M – 356M
- Лицензия
- Только некоммерческоеЛицензия на веса и код в репозитории не указана — файла LICENSE нет, прав на коммерческое использование никто не давал; условия надо уточнять у Samsung (лицензия CC BY 4.0 относится только к статье на arXiv)
- Русский язык
- Нет
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Медиа и продакшн, Производство и склад, Наука
Какие задачи решает
- Описание аудиозаписи словами
- Ответы на вопросы о звуке
- Определение типа звука и обстановки
- Обработка звука на устройстве без отправки в облако
Где применяется
Требования к железу
Версии
- Samsone-99M / 134M / 356M
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать Samsone в коммерческом проекте?
Нет. Лицензия: Лицензия на веса и код в репозитории не указана — файла LICENSE нет, прав на коммерческое использование никто не давал; условия надо уточнять у Samsung (лицензия CC BY 4.0 относится только к статье на arXiv). Для коммерческого продукта нужна другая модель или отдельное соглашение с правообладателем.
Какое железо нужно для Samsone?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли Samsone русский язык?
Нет. В карточке перечислены языки, русского среди них нет. Для русских задач лучше взять модель из подборки «Открытые ИИ-модели с русским языком».
Где скачать Samsone и сколько это стоит?
Веса Samsone лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Модели, которые слушают речь, звуки и музыку и отвечают на вопросы о них. Audio Flamingo Next разбирает записи до 30 минут. Только для исследований.
ПодробнееГолосовые ассистентыKimi-AudioMoonshot AI · КитайМожно в коммерциюУниверсальная аудиомодель: распознаёт речь, отвечает на вопросы о звуке, определяет эмоции и ведёт голосовой диалог. Обучена на 13 млн часов аудио, языки — английский и китайский.
ПодробнееГолосовые ассистентыQwen OmniAlibaba (Qwen) · КитайМожно в коммерциюМодели, которые понимают текст, картинки, аудио и видео и отвечают голосом в реальном времени. Qwen3-Omni говорит на 10 языках, включая русский.
ПодробнееИсточник: github.com/SamsungLabs/samsone/releases/tag/v1.0.0. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


