Документы и OCR

Table Transformer

Небольшие модели, которые находят таблицы на страницах PDF и сканов и восстанавливают их структуру: строки, столбцы, заголовки. Текст внутри читает отдельный OCR.

Разработчик
Microsoft, США
Первый выпуск
окт 2022
Последний выпуск
ноя 2023
Размеры
29M
Лицензия
Можно в коммерциюMIT
Запуск
Через свой серверРаботает и без видеокарты
Сферы
Документы и бухгалтерия, Финансы

Какие задачи решает

  • Поиск таблиц в отчётах, выписках и счетах
  • Восстановление строк и столбцов для выгрузки в Excel
  • Подготовка табличных данных для анализа и RAG

Где применяется

Бухгалтерия и финансыДокументооборотАналитика

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Структура v1.1 (all, pub, fin)
  2. Table Transformer: поиск таблиц и распознавание структуры

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели