Документы и OCR
PP-OCR и PP-DocLayout (классический PaddleOCR)
Классические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.
- Разработчик
- Baidu (PaddlePaddle), Китай
- Первый выпуск
- май 2022
- Последний выпуск
- июн 2026
- Размеры
- от 1.5M до десятков миллионов параметров
- Лицензия
- Можно в коммерциюApache 2.0
- Русский язык
- Есть
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Документы и бухгалтерия, Финансы, Производство и склад, Торговля и маркетплейсы
Какие задачи решает
- Распознавание текста на сканах, фото и экранах
- Чтение этикеток, табло, маркировки на производстве и складе
- Разметка страниц: таблицы, формулы, печати, заголовки
- Встраивание OCR в мобильные и офлайн-приложения
Где применяется
ДокументооборотСклад и логистикаПроизводствоРозница
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- PP-OCRv6 (tiny, small, medium)
- PP-DocLayoutV3
- PP-DocLayoutV2
- PP-OCRv5 для восточнославянских языков
- PP-OCRv5 и PP-DocLayout (PaddleOCR 3.0)
- PP-OCRv4
- PP-OCRv3
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Документы и OCRPaddleOCR-VLBaidu (PaddlePaddle) · КитайМожно в коммерцию
Компактная модель для разбора документов из популярного набора PaddleOCR. По карточке поддерживает 109 языков, в том числе русский; версия 1.6 лидирует на тесте OmniDocBench.
ПодробнееДокументы и OCRSurya OCRDatalab · СШАКоммерция с условиямиКомпактный набор OCR от авторов Marker и Chandra: распознавание текста, макет страницы, порядок чтения и таблицы. Surya OCR 2 (650M) работает и на процессоре, русский в замерах 88,8%.
ПодробнееДокументы и OCRSmolDocling и Granite-DoclingIBM и Hugging Face · СШАМожно в коммерциюКрошечные модели для открытого конвертера документов Docling: переводят страницу в разметку с таблицами, формулами и кодом. Работают на обычном ноутбуке.
Подробнее

