DSE (Document Screenshot Embedding)
Ищет по скриншотам страниц: страницу не распознают, а превращают целиком в один вектор — индекс компактнее, чем у моделей с поздним взаимодействием. Языки в карточке: английский и французский.
- Разработчик
- Университет Ватерлоо, проект Tevatron, Канада
- Первый выпуск
- сен 2024
- Последний выпуск
- сен 2024
- Размеры
- 2B (на базе Qwen2-VL)
- Лицензия
- Можно в коммерциюApache 2.0
- Русский язык
- Нет
- Запуск
- Через свой серверНужна видеокарта
- Сферы
- Документы и бухгалтерия, Юристы, Финансы, Наука
Какие задачи решает
- Поиск по сканам и PDF без распознавания текста
- Поиск по презентациям и отчётам со сложной вёрсткой
- Подбор страниц для ответа ИИ-помощника
Где применяется
Требования к железу
Версии
- dse-qwen2-2b-mrl-v1
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать DSE (Document Screenshot Embedding) в коммерческом проекте?
Да. Лицензия: Apache 2.0. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для DSE (Document Screenshot Embedding)?
Минимум: Одна видеокарта на 16–80 ГБ — средние версии. Без видеокарты модель практически не работает. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли DSE (Document Screenshot Embedding) русский язык?
Нет. В документации разработчика языки перечислены, русского среди них нет. Для русских задач лучше взять модель из подборки «Открытые ИИ-модели с русским языком».
Где скачать DSE (Document Screenshot Embedding) и сколько это стоит?
Веса DSE (Document Screenshot Embedding) лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Поиск по PDF и сканам как по картинкам: страницу не нужно распознавать, модель сразу находит нужную по вопросу, включая таблицы и схемы. Обучены на английском.
ПодробнееПоиск по сканам документовGME (General Multimodal Embedding)Alibaba (Tongyi Lab) · КитайМожно в коммерциюОдин вектор и для текста, и для картинки, и для их пары: одной моделью можно искать товар по фото, страницу документа по вопросу и картинку по описанию. Языки в карточке: английский и китайский.
ПодробнееПоиск по сканам документовModernVBERT / ColModernVBERTIlluin Technology, EPFL, CentraleSupélec · ФранцияМожно в коммерциюКомпактная (250M) модель для поиска по страницам документов как по картинкам. По данным авторов, не уступает моделям в 10 раз крупнее и работает без видеокарты.
ПодробнееИсточник: huggingface.co/MrLight/dse-qwen2-2b-mrl-v1. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


