Qwen-VL или InternVL: что выбрать для работы с изображениями
Обе линейки читают документы, отвечают по фото и разбирают видео, обе масштабируются от процессора до кластера. Qwen-VL от Alibaba есть в Ollama, поэтому поставить её на сервер проще всего; свежая Qwen3-VL идёт под Apache 2.0, а у старых Qwen-VL и части Qwen2/2.5-VL (3B, 72B) собственные лицензии Qwen, это стоит проверить до внедрения. InternVL от Shanghai AI Laboratory обновлялась позже (2026-03 против 2025-10) и начинается с 1B, а версия InternVL-U на 4B под MIT ещё и генерирует и правит картинки. В каталоге Qwen-VL отмечен для бухгалтерии, розницы, e-commerce и поддержки, InternVL — для документооборота, промышленности с контролем качества и e-commerce.
Сравнение по данным каталога
| Параметр | Qwen-VL | InternVL |
|---|---|---|
| Направление | Картинка + текст, Документы и OCR | Картинка + текст |
| Разработчик | Alibaba (команда Qwen), Китай | Shanghai AI Laboratory (OpenGVLab), Китай |
| Выпуски | авг 2023 – окт 2025 | дек 2023 – мар 2026 |
| Размеры | 2B – 235B-A22B | 1B – 241B-A28B |
| Железо | Ноутбук, 1 видеокарта, Кластер | Ноутбук, 1 видеокарта, Кластер |
| Коммерция | Можно в коммерцию | Можно в коммерцию |
| Лицензия | Qwen3-VL — Apache 2.0; у старых Qwen-VL и части Qwen2/2.5-VL (3B, 72B) собственные лицензии Qwen | InternVL3.5 — Apache 2.0; InternVL-U — MIT; отдельные крупные версии наследуют лицензию базовой модели (например, Qwen) |
| Русский язык | Не заявлен | Не заявлен |
| Ollama | Есть | Нет |
| Без видеокарты | Да | Да |
| Задачи |
|
|
Выбирайте Qwen-VL, если
- Нужен простой запуск: Qwen-VL есть в Ollama, InternVL — нет
- Задача — агент, который работает с интерфейсом по скриншотам
- Разбираете сканы счетов и накладных, фото витрин и записи с камер
Выбирайте InternVL, если
- Нужна одна модель и на понимание, и на генерацию картинок: InternVL-U (4B) под MIT
- Важна самая свежая версия: последний релиз InternVL — 2026-03
- Контроль качества на производстве, схемы и графики в документах
Другие сравнения
- MiniCPM-V или Qwen-VL: что выбрать для распознавания фото
- Qwen или GigaChat: что выбрать для бизнеса
- Qwen или Llama: что выбрать для бизнеса
- DeepSeek или Qwen: что выбрать для бизнеса
- Gemma или Llama: что выбрать для бизнеса
- Mistral или Llama: что выбрать для бизнеса
- PaddleOCR-VL или DeepSeek-OCR: что выбрать для бизнеса
- gpt-oss или Qwen: что выбрать для своего сервера
- Llama или DeepSeek: что выбрать для своего контура
- Mistral или Qwen: что выбрать для бизнеса
- Gemma или Phi: малые модели для слабого железа
- YandexGPT или Qwen: что выбрать под русский язык
Нужна модель под вашу задачу?
Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.
- ПодберуМодель и размер под задачу и бюджет на железо
- ПоставлюНа ваш сервер или в закрытый контур, с API
- ДообучуНа ваших данных или подключу базу знаний
- ВстроюВ CRM, 1С, бота, сайт или рабочий чат


