Документы и OCR
TeleOCR
Новая лёгкая модель для разбора документов, на момент выхода лидер теста OmniDocBench v1.6. Хорошо справляется со снятыми на телефон и помятыми страницами. Языки в карточке — китайский, английский, японский.
- Разработчик
- TeleAI (China Telecom), Китай
- Первый выпуск
- авг 2026
- Последний выпуск
- авг 2026
- Размеры
- около 1.2B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Распознавание счетов и накладных, снятых на телефон
- Распознавание таблиц и формул
- Перевод документов в Markdown для RAG
Где применяется
ДокументооборотЛогистикаБухгалтерия
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- TeleOCR
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Документы и OCRPaddleOCR-VLBaidu (PaddlePaddle) · КитайМожно в коммерцию
Компактная модель для разбора документов из популярного набора PaddleOCR. По карточке поддерживает 109 языков, в том числе русский; версия 1.6 лидирует на тесте OmniDocBench.
ПодробнееДокументы и OCRQianfan-OCRBaidu (Qianfan) · КитайМожно в коммерциюМодель Baidu, которая не только распознаёт документ, но и отвечает на вопросы по нему. По карточке поддерживает 192 языка, включая кириллицу.
ПодробнееДокументы и OCRMinerUShanghai AI Laboratory (OpenDataLab) · КитайМожно в коммерциюПопулярный открытый инструмент перевода PDF в Markdown со своей небольшой моделью. MinerU2.5-Pro улучшили только за счёт данных, без роста размера. Языки в карточке — китайский и английский.
Подробнее

