Документы и OCR
Table Transformer
Небольшие модели, которые находят таблицы на страницах PDF и сканов и восстанавливают их структуру: строки, столбцы, заголовки. Текст внутри читает отдельный OCR.
- Разработчик
- Microsoft, США
- Первый выпуск
- окт 2022
- Последний выпуск
- ноя 2023
- Размеры
- 29M
- Лицензия
- Можно в коммерциюMIT
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Документы и бухгалтерия, Финансы
Какие задачи решает
- Поиск таблиц в отчётах, выписках и счетах
- Восстановление строк и столбцов для выгрузки в Excel
- Подготовка табличных данных для анализа и RAG
Где применяется
Бухгалтерия и финансыДокументооборотАналитика
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Структура v1.1 (all, pub, fin)
- Table Transformer: поиск таблиц и распознавание структуры
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Документы и OCRSmolDocling и Granite-DoclingIBM и Hugging Face · СШАМожно в коммерцию
Крошечные модели для открытого конвертера документов Docling: переводят страницу в разметку с таблицами, формулами и кодом. Работают на обычном ноутбуке.
ПодробнееДокументы и OCRPP-OCR и PP-DocLayout (классический PaddleOCR)Baidu (PaddlePaddle) · КитайМожно в коммерциюКлассические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.
ПодробнееДокументы и OCRSurya OCRDatalab · СШАКоммерция с условиямиКомпактный набор OCR от авторов Marker и Chandra: распознавание текста, макет страницы, порядок чтения и таблицы. Surya OCR 2 (650M) работает и на процессоре, русский в замерах 88,8%.
Подробнее

