Документы и OCR

HunyuanOCR

Лёгкая OCR-модель Tencent: разбор документов, поиск текста на фото, извлечение полей и перевод текста с картинок. Версия 1.5 быстрее и запускается на обычном ПК.

Разработчик
Tencent, Китай
Первый выпуск
ноя 2025
Последний выпуск
июл 2026
Размеры
1B
Лицензия
Коммерция с условиямиTencent Hunyuan Community License (коммерция разрешена, но не действует в ЕС, Великобритании и Южной Корее)

Какие задачи решает

  • Извлечение полей из счетов и накладных
  • Распознавание таблиц и формул
  • Перевод текста на фотографиях и сканах
  • Чтение текста на фото и в видео

Где применяется

ДокументооборотЛогистикаБухгалтерия

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. HunyuanOCR-1.5
  2. HunyuanOCR 1.0

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели