Документы и OCRКартинка + текст

WeVisDoc

Разбирает страницу документа целиком: превращает её в Markdown с формулами в LaTeX и таблицами в HTML. Версия 4B на OmniDocBench v1.6 набирает 95,38. Языки в карточке: английский и китайский.

Разработчик
Tencent, Китай
Первый выпуск
сен 2026
Последний выпуск
сен 2026
Размеры
2B и 4B
Лицензия
Можно в коммерциюApache 2.0
Русский язык
Нет
Запуск
Через свой серверНужна видеокарта
Сферы
Документы и бухгалтерия, Финансы, Юристы

Какие задачи решает

  • перевод сканов и PDF в Markdown для поиска и RAG
  • распознавание таблиц и формул
  • разбор отчётов и научных статей

Где применяется

документооборот и бухгалтерияюридические отделыфинансы и аналитика

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. WeVisDoc-4B
  2. WeVisDoc-2B

Как запустить

На своём сервереВеса скачиваются с Hugging Face, запуск — через vLLM (нагрузка и API) или llama.cpp (скромное железо). Так модель работает в закрытом контуре, без оплаты за запросы.Hugging Face
Сколько нужно железаПосчитайте видеопамять под нужный размер модели, контекст и число одновременных запросов.Открыть калькулятор железа

Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.

Частые вопросы

Можно ли использовать WeVisDoc в коммерческом проекте?

Да. Лицензия: Apache 2.0. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.

Какое железо нужно для WeVisDoc?

Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Без видеокарты модель практически не работает. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.

Поддерживает ли WeVisDoc русский язык?

Нет. В документации разработчика языки перечислены, русского среди них нет. Для русских задач лучше взять модель из подборки «Открытые ИИ-модели с русским языком».

Где скачать WeVisDoc и сколько это стоит?

Веса WeVisDoc лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели

Документы и OCRSmolDocling и Granite-DoclingIBM и Hugging Face · СШАМожно в коммерцию

Крошечные модели для открытого конвертера документов Docling: переводят страницу в разметку с таблицами, формулами и кодом. Работают на обычном ноутбуке.

Подробнее
Документы и OCRLightOnOCRLightOn · ФранцияМожно в коммерцию

Французская OCR-модель, которая переводит страницу в текст за один проход и быстро работает на потоке. В третьем поколении (0,8B, 1B, 4B) возвращает ещё и координаты блоков, описания картинок и данные графиков в таблицу. Языки в карточке 2-й версии европейские, китайский и японский, русского нет.

Подробнее
Документы и OCRYoutu-Parsing-OmniTencent · КитайКоммерция с условиями

Одна компактная модель превращает страницу документа, график, блок-схему, геометрический чертёж, аудио или видео в структурированный JSON: с координатами блоков, таблицами, формулами, расшифровкой речи и временными метками.

Подробнее

Источник: huggingface.co/tencent/WeVisDoc-4B. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.