Голосовые ассистентыКартинка + текст
Qwen Omni
Модели, которые понимают текст, картинки, аудио и видео и отвечают голосом в реальном времени. Qwen3-Omni говорит на 10 языках, включая русский.
- Разработчик
- Alibaba (Qwen), Китай
- Первый выпуск
- мар 2025
- Последний выпуск
- сен 2025
- Размеры
- 3B – 30B-A3B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Голосовой ассистент для клиентов
- Разбор звонков и видео
- Ответы голосом по документам и картинкам
- Описание аудиозаписей
Где применяется
Колл-центрыРитейл и сервисМедиаВнутренние помощники
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Qwen3-Omni 30B-A3B (Instruct, Thinking, Captioner)
- Qwen2.5-Omni 3B
- Qwen2.5-Omni 7B
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Голосовые ассистентыMiniCPM-oOpenBMB (ModelBest, Университет Цинхуа) · КитайМожно в коммерцию
Небольшая модель, которая видит, слышит и отвечает голосом в реальном времени, может клонировать голос. Голосовой диалог на английском и китайском, текст — на 30+ языках.
ПодробнееГолосовые ассистентыMoshi / HibikiKyutai · ФранцияКоммерция с условиямиГолосовой ассистент, который слушает и говорит одновременно, без задержки на распознавание и синтез. Hibiki — синхронный перевод речи в речь между несколькими европейскими языками.
ПодробнееТекстQwenAlibaba · КитайКоммерция с условиямиСемейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.
Подробнее

