Документы и OCR

PP-OCR и PP-DocLayout (классический PaddleOCR)

Классические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.

Разработчик
Baidu (PaddlePaddle), Китай
Первый выпуск
май 2022
Последний выпуск
июн 2026
Размеры
от 1.5M до десятков миллионов параметров
Лицензия
Можно в коммерциюApache 2.0
Русский язык
Есть
Запуск
Через свой серверРаботает и без видеокарты
Сферы
Документы и бухгалтерия, Финансы, Производство и склад, Торговля и маркетплейсы

Какие задачи решает

  • Распознавание текста на сканах, фото и экранах
  • Чтение этикеток, табло, маркировки на производстве и складе
  • Разметка страниц: таблицы, формулы, печати, заголовки
  • Встраивание OCR в мобильные и офлайн-приложения

Где применяется

ДокументооборотСклад и логистикаПроизводствоРозница

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. PP-OCRv6 (tiny, small, medium)
  2. PP-DocLayoutV3
  3. PP-DocLayoutV2
  4. PP-OCRv5 для восточнославянских языков
  5. PP-OCRv5 и PP-DocLayout (PaddleOCR 3.0)
  6. PP-OCRv4
  7. PP-OCRv3

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели