Документы и OCR

DeepSeek-OCR

OCR-модель, которая сильно сжимает страницу в небольшое число визуальных токенов, поэтому быстро обрабатывает большие объёмы. Версия 2 лучше понимает порядок чтения.

Разработчик
DeepSeek, Китай
Первый выпуск
окт 2025
Последний выпуск
янв 2026
Размеры
около 3B
Лицензия
Можно в коммерциюDeepSeek-OCR — MIT; DeepSeek-OCR 2 — Apache 2.0

Какие задачи решает

  • Массовое распознавание сканов счетов и договоров
  • Распознавание таблиц
  • Перевод PDF в Markdown для поиска и RAG

Где применяется

ДокументооборотБухгалтерияАрхивы

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. DeepSeek-OCR 2
  2. DeepSeek-OCR

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели