Документы и OCR

olmOCR

Модель и набор инструментов для массового перевода PDF в чистый текст с сохранением порядка чтения, таблиц и формул. Рассчитана на обработку миллионов страниц.

Разработчик
Ai2 (Allen Institute for AI), США
Первый выпуск
фев 2025
Последний выпуск
окт 2025
Размеры
7B
Лицензия
Можно в коммерциюApache 2.0

Какие задачи решает

  • Массовая оцифровка архива PDF
  • Распознавание договоров и отчётов в текст
  • Подготовка документов для поиска и RAG
  • Распознавание таблиц

Где применяется

ДокументооборотЮридические отделыАрхивы и библиотеки

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
нет версий
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. olmOCR-2-7B-1025
  2. olmOCR-7B-0825
  3. olmOCR-7B-0725
  4. olmOCR-7B-0225-preview

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели