Nemotron 3 Diarization
Размечает запись по говорящим: кто и когда говорил, до восьми участников, в записи и в прямом эфире. Модель маленькая, есть сборка GGUF и запуск без видеокарты. Записи разговоров это персональные данные, порядок хранения согласуется с юристом.
- Разработчик
- NVIDIA, США
- Первый выпуск
- авг 2026
- Последний выпуск
- сен 2026
- Размеры
- 100M
- Лицензия
- Можно в коммерциюOpenMDW 1.1
- Готовые сборки
- GGUF
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Поддержка клиентов, Документы и бухгалтерия, Медиа и продакшн
Какие задачи решает
- Разбор записи звонка или совещания по участникам
- Подстановка имён говорящих в расшифровку
- Потоковая разметка во время разговора
- Подготовка протокола встречи с несколькими участниками
Где применяется
Требования к железу
Версии
- Nemotron 3 Diarization
- Nemotron 3 Diarization preview
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам. Квантование — сжатие модели: она занимает меньше видеопамяти и работает на более скромном железе. Отвечает при этом чуть иначе, поэтому качество проверяют на своих примерах.
Частые вопросы
Можно ли использовать Nemotron 3 Diarization в коммерческом проекте?
Да. Лицензия: OpenMDW 1.1. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для Nemotron 3 Diarization?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли Nemotron 3 Diarization русский язык?
Для этой модели язык не важен: она работает не с текстом.
Где скачать Nemotron 3 Diarization и сколько это стоит?
Веса Nemotron 3 Diarization лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Модели NVIDIA для задачи «кто говорит»: TitaNet узнаёт голос конкретного человека, Sortformer размечает запись до 4 спикеров, в том числе потоково во время звонка.
ПодробнееГолос: спикеры и звукpyannote (диаризация)pyannoteAI (Эрве Бредин) · ФранцияМожно в коммерциюСамый распространённый открытый инструмент, который размечает запись по спикерам: кто и когда говорил. Обычно ставится в связку с распознаванием речи. Веса выдаются после короткой анкеты на HF.
ПодробнееГолос: спикеры и звукWeSpeakerСообщество WeNet · КитайМожно в коммерциюНабор готовых моделей «голосового отпечатка»: сравнивает, один ли человек говорит в двух записях, и помогает делить запись по спикерам. Одна из моделей встроена в pyannote 3.x.
ПодробнееИсточник: huggingface.co/nvidia/Nemotron-3-Diarization. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


