vLLM Semantic Router: Decision и Vela
Открытое семейство моделей для ИИ-шлюза: на запрос отвечают вероятностями, не генерируя текст. Определяют тему и срочность, попытку взлома, вредный запрос, персональные данные, нужен ли инструмент. Малые версии работают на процессоре, Vela понимает 17 языков, включая русский.
- Разработчик
- проект vLLM Semantic Router, международный проект
- Первый выпуск
- сен 2026
- Последний выпуск
- окт 2026
- Размеры
- 0.3B – 27B
- Лицензия
- Можно в коммерциюApache 2.0
- Русский язык
- Есть
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Безопасность, Поддержка клиентов, Разработка ПО, Документы и бухгалтерия
Какие задачи решает
- маршрутизация запросов между моделями и командами
- проверка запроса на попытку взлома и вредное содержание до основной модели
- поиск персональных данных с координатами в тексте
- выявление утверждений в ответе ИИ без опоры на источник
Где применяется
Требования к железу
Версии
- Vela 2.0 (0.3B, 0.8B, 4B, 9B)
- Decision 2.0 (Kai 0.6B, Eos 0.8B, Sol 2B, Nox 4B, Lux 9B, Vega 27B)
- Decision 1.0 (Kai, Eos, Lux, Route 0.6B)
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать vLLM Semantic Router: Decision и Vela в коммерческом проекте?
Да. Лицензия: Apache 2.0. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для vLLM Semantic Router: Decision и Vela?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли vLLM Semantic Router: Decision и Vela русский язык?
Да, русский язык заявлен в карточке модели.
Где скачать vLLM Semantic Router: Decision и Vela и сколько это стоит?
Веса vLLM Semantic Router: Decision и Vela лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Модели решений: не пишут текст, а читают ситуацию (текст, JSON, картинку, кадры видео) и за один проход возвращают вероятность каждого варианта ответа на типизированные вопросы «да или нет», «выбери один» и «оцени по шкале». Вместо разбора свободного текста агент получает готовые числа.
ПодробнееРазбор текстаJEV и GEVAutoTrust AI · СингапурМожно в коммерциюОткрытые модели решений: на вопросы «да или нет», «выбери вариант», «оцени от 0 до 5» отвечают вероятностями за один проход, а при нужде ещё и рассуждают. Не связаны с закрытой Jev от TypeSafe.
ПодробнееРазбор текстаLiquid d1Liquid AI · СШАКоммерция с условиямиМаленькие модели решений: по тексту, картинке или голосовой записи отвечают «да или нет», выбирают вариант или ставят оценку за один проход, текст не пишут. d1-3B видит картинки, d1-omni-600M ещё и слышит речь до 30 секунд. Русский заявлен.
ПодробнееИсточник: huggingface.co/vllm-sr/Vela-2.0-0.3B. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


