Документы и OCR
DeepSeek-OCR
OCR-модель, которая сильно сжимает страницу в небольшое число визуальных токенов, поэтому быстро обрабатывает большие объёмы. Версия 2 лучше понимает порядок чтения.
- Разработчик
- DeepSeek, Китай
- Первый выпуск
- окт 2025
- Последний выпуск
- янв 2026
- Размеры
- около 3B
- Лицензия
- Можно в коммерциюDeepSeek-OCR — MIT; DeepSeek-OCR 2 — Apache 2.0
Какие задачи решает
- Массовое распознавание сканов счетов и договоров
- Распознавание таблиц
- Перевод PDF в Markdown для поиска и RAG
Где применяется
ДокументооборотБухгалтерияАрхивы
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- DeepSeek-OCR 2
- DeepSeek-OCR
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Документы и OCRPaddleOCR-VLBaidu (PaddlePaddle) · КитайМожно в коммерцию
Компактная модель для разбора документов из популярного набора PaddleOCR. По карточке поддерживает 109 языков, в том числе русский; версия 1.6 лидирует на тесте OmniDocBench.
ПодробнееДокументы и OCRdots.ocrrednote hilab (Xiaohongshu) · КитайМожно в коммерциюМногоязычная модель для разбора документов: текст, таблицы, формулы и порядок чтения за один проход. dots.mocr ещё переводит графики и схемы в векторный SVG.
ПодробнееДокументы и OCRGLM-OCRZhipu AI (Z.ai) · КитайМожно в коммерциюЛёгкая OCR-модель Zhipu для разбора документов. В карточке русский указан среди поддерживаемых языков; рассчитана на высокую нагрузку и слабое железо.
Подробнее

