Картинка + текст

InternVL

Большая линейка китайских моделей зрения с размерами от 1B до 241B. InternVL-U (4B) объединяет понимание картинок, их генерацию и редактирование.

Разработчик
Shanghai AI Laboratory (OpenGVLab), Китай
Первый выпуск
дек 2023
Последний выпуск
мар 2026
Размеры
1B – 241B-A28B
Лицензия
Можно в коммерциюInternVL3.5 — Apache 2.0; InternVL-U — MIT; отдельные крупные версии наследуют лицензию базовой модели (например, Qwen)

Какие задачи решает

  • Понимание документов, схем и графиков
  • Ответы на вопросы по фото
  • Разбор видео
  • Генерация и правка картинок (InternVL-U)

Где применяется

ДокументооборотПромышленность и контроль качестваЭлектронная коммерция

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
подходит

Версии

  1. InternVL-U
  2. InternVL3.5
  3. InternVL3
  4. InternVL2.5
  5. InternVL2
  6. InternVL 1.5
  7. InternVL

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели