Голос: спикеры и звукМузыка и звук

SAM Audio

Модель вырезает из записи нужный звук по текстовому описанию, по отметке на видео или по отрезку: голос, инструмент, шум. Доступ к весам выдают по заявке.

Разработчик
Meta, США
Первый выпуск
дек 2025
Последний выпуск
дек 2025
Размеры
small, base, large (от 5 до 15 ГБ весов)
Лицензия
Коммерция с условиямиSAM License: коммерция разрешена, есть санкционные и военные ограничения; доступ по заявке на HF

Какие задачи решает

  • Выделить голос одного человека из шумной записи
  • Убрать посторонний звук из видео
  • Разобрать запись на отдельные источники звука

Где применяется

Медиа и продакшнВидеосъёмка и монтажСлужбы расшифровки

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
нет версий
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. SAM Audio (small, base, large)

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели