Документы и OCR

Unlimited-OCR

OCR-модель Baidu, развивающая идеи DeepSeek-OCR: разбирает многостраничные документы и PDF целиком за один проход и выдаёт размеченный текст. Заявлена как многоязычная, но список языков не опубликован.

Разработчик
Baidu, Китай
Первый выпуск
июн 2026
Последний выпуск
июн 2026
Размеры
3.3B
Лицензия
Можно в коммерциюMIT
Русский язык
Не заявлен
Запуск
Через свой серверНужна видеокарта
Сферы
Документы и бухгалтерия, Финансы, Юристы

Какие задачи решает

  • Перевод многостраничных PDF и сканов в текст и Markdown
  • Распознавание договоров, счетов и отчётов
  • Подготовка архивов документов к поиску и RAG

Где применяется

ДокументооборотБухгалтерияЮридические отделыАрхивы

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Unlimited-OCR

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели