Документы и OCR

Chandra OCR

Сильная OCR-модель от авторов Marker и Surya: рукописный текст, формы, таблицы. По карточке поддерживает 90+ языков, русский есть среди примеров.

Разработчик
Datalab, США
Первый выпуск
окт 2025
Последний выпуск
мар 2026
Размеры
5B – 9B
Лицензия
Коммерция с условиямиМодифицированная OpenRAIL-M: бесплатно для исследований и компаний с выручкой и инвестициями до 2 млн долларов, нельзя конкурировать с их API; остальным — платная лицензия

Какие задачи решает

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Распознавание рукописных форм и анкет
  • Распознавание сложных таблиц

Где применяется

ДокументооборотБухгалтерияСтрахование и банки

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Chandra OCR 2
  2. Chandra

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели