Разбор текстаМодерация и безопасность

vLLM Semantic Router: Decision и Vela

Открытое семейство моделей для ИИ-шлюза: на запрос отвечают вероятностями, не генерируя текст. Определяют тему и срочность, попытку взлома, вредный запрос, персональные данные, нужен ли инструмент. Малые версии работают на процессоре, Vela понимает 17 языков, включая русский.

Разработчик
проект vLLM Semantic Router, международный проект
Первый выпуск
сен 2026
Последний выпуск
окт 2026
Размеры
0.3B – 27B
Лицензия
Можно в коммерциюApache 2.0
Русский язык
Есть
Запуск
Через свой серверРаботает и без видеокарты
Сферы
Безопасность, Поддержка клиентов, Разработка ПО, Документы и бухгалтерия

Какие задачи решает

  • маршрутизация запросов между моделями и командами
  • проверка запроса на попытку взлома и вредное содержание до основной модели
  • поиск персональных данных с координатами в тексте
  • выявление утверждений в ответе ИИ без опоры на источник

Где применяется

ИИ-шлюзы и корпоративные ассистентыинформационная безопасностьподдержка клиентов

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Vela 2.0 (0.3B, 0.8B, 4B, 9B)
  2. Decision 2.0 (Kai 0.6B, Eos 0.8B, Sol 2B, Nox 4B, Lux 9B, Vega 27B)
  3. Decision 1.0 (Kai, Eos, Lux, Route 0.6B)

Как запустить

На своём сервереВеса скачиваются с Hugging Face, запуск — через vLLM (нагрузка и API) или llama.cpp (скромное железо). Так модель работает в закрытом контуре, без оплаты за запросы.Hugging Face
Сколько нужно железаПосчитайте видеопамять под нужный размер модели, контекст и число одновременных запросов.Открыть калькулятор железа

Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.

Частые вопросы

Можно ли использовать vLLM Semantic Router: Decision и Vela в коммерческом проекте?

Да. Лицензия: Apache 2.0. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.

Какое железо нужно для vLLM Semantic Router: Decision и Vela?

Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.

Поддерживает ли vLLM Semantic Router: Decision и Vela русский язык?

Да, русский язык заявлен в карточке модели.

Где скачать vLLM Semantic Router: Decision и Vela и сколько это стоит?

Веса vLLM Semantic Router: Decision и Vela лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели

Разбор текстаClefCloudflare · СШАМожно в коммерцию

Модели решений: не пишут текст, а читают ситуацию (текст, JSON, картинку, кадры видео) и за один проход возвращают вероятность каждого варианта ответа на типизированные вопросы «да или нет», «выбери один» и «оцени по шкале». Вместо разбора свободного текста агент получает готовые числа.

Подробнее
Разбор текстаJEV и GEVAutoTrust AI · СингапурМожно в коммерцию

Открытые модели решений: на вопросы «да или нет», «выбери вариант», «оцени от 0 до 5» отвечают вероятностями за один проход, а при нужде ещё и рассуждают. Не связаны с закрытой Jev от TypeSafe.

Подробнее
Разбор текстаLiquid d1Liquid AI · СШАКоммерция с условиями

Маленькие модели решений: по тексту, картинке или голосовой записи отвечают «да или нет», выбирают вариант или ставят оценку за один проход, текст не пишут. d1-3B видит картинки, d1-omni-600M ещё и слышит речь до 30 секунд. Русский заявлен.

Подробнее

Источник: huggingface.co/vllm-sr/Vela-2.0-0.3B. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.