LensVLM
Читает длинные документы иначе: превращает страницы в уменьшенные картинки и разворачивает полный текст только тех страниц, которые нужны для ответа. Так на длинный документ уходит меньше контекста.
- Разработчик
- Apple, США
- Первый выпуск
- сен 2026
- Последний выпуск
- сен 2026
- Размеры
- 9B
- Лицензия
- Только некоммерческоеApple Machine Learning Research Model License: только исследования, коммерческое использование не разрешено. Модель дообучена из Qwen3.5-9B, условия базовой модели тоже действуют
- Русский язык
- Не заявлен
- Запуск
- Через свой серверНужна видеокарта
- Сферы
- Документы и бухгалтерия, Наука, Юристы
Какие задачи решает
- Ответы по многостраничным документам
- Поиск нужной страницы в большом отчёте или деле
- Разбор сканов и PDF без предварительного распознавания
- Исследования по работе с длинным контекстом
Где применяется
Требования к железу
Версии
- LensVLM-9B
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать LensVLM в коммерческом проекте?
Нет. Лицензия: Apple Machine Learning Research Model License: только исследования, коммерческое использование не разрешено. Модель дообучена из Qwen3.5-9B, условия базовой модели тоже действуют. Для коммерческого продукта нужна другая модель или отдельное соглашение с правообладателем.
Какое железо нужно для LensVLM?
Минимум: Одна видеокарта на 16–80 ГБ — средние версии. Без видеокарты модель практически не работает. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли LensVLM русский язык?
В карточке модели языки не перечислены, поэтому поддержку русского обещать нельзя — её нужно проверять на ваших примерах.
Где скачать LensVLM и сколько это стоит?
Веса LensVLM лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Поиск по PDF и сканам как по картинкам: страницу не нужно распознавать, модель сразу находит нужную по вопросу, включая таблицы и схемы. Обучены на английском.
ПодробнееКартинка + текстQwen-VLAlibaba (команда Qwen) · КитайМожно в коммерциюОдна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.
ПодробнееДокументы и OCRSmolDocling и Granite-DoclingIBM и Hugging Face · СШАМожно в коммерциюКрошечные модели для открытого конвертера документов Docling: переводят страницу в разметку с таблицами, формулами и кодом. Работают на обычном ноутбуке.
ПодробнееИсточник: huggingface.co/apple/LensVLM-9B. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


