Документы и OCR

Nanonets-OCR

Модель для перевода документов в Markdown с таблицами, печатями, подписями, галочками и водяными знаками. В карточке OCR2 русский указан среди языков.

Разработчик
Nanonets, США / Индия
Первый выпуск
июн 2025
Последний выпуск
окт 2025
Размеры
1.5B – 3B
Лицензия
Коммерция с условиямиNanonets-OCR2-1.5B-exp — Apache 2.0; у 3B-версий лицензия на карточке не указана, основа — Qwen2.5-VL-3B со своей лицензией

Какие задачи решает

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Распознавание печатей, подписей и отметок
  • Распознавание рукописного текста
  • Распознавание таблиц

Где применяется

ДокументооборотБухгалтерияЮридические отделы

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Nanonets-OCR2 1.5B и 3B
  2. Nanonets-OCR-s

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели