Документы и OCR
Nougat
Ранняя модель, переводящая научные PDF в текст с формулами. Сегодня устарела, её обходят почти все современные OCR-модели.
- Разработчик
- Meta, США
- Первый выпуск
- сен 2023
- Последний выпуск
- сен 2023
- Размеры
- 250M – 350M
- Лицензия
- Коммерция с условиямиБольшая версия — CC-BY-NC 4.0 (некоммерческая), малая — CC-BY 4.0
Какие задачи решает
- Перевод научных статей из PDF в текст с формулами
- Оцифровка технической документации
Где применяется
Наука и образованиеТехнические архивы
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Nougat small / base
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Документы и OCRGOT-OCR 2.0StepFun · КитайМожно в коммерцию
Одна из первых универсальных OCR-моделей нового поколения: текст, формулы, таблицы, ноты и схемы. Маленькая, работает на слабом железе, но уже уступает новинкам.
ПодробнееДокументы и OCRolmOCRAi2 (Allen Institute for AI) · СШАМожно в коммерциюМодель и набор инструментов для массового перевода PDF в чистый текст с сохранением порядка чтения, таблиц и формул. Рассчитана на обработку миллионов страниц.
ПодробнееДокументы и OCRMinerUShanghai AI Laboratory (OpenDataLab) · КитайМожно в коммерциюПопулярный открытый инструмент перевода PDF в Markdown со своей небольшой моделью. MinerU2.5-Pro улучшили только за счёт данных, без роста размера. Языки в карточке — китайский и английский.
Подробнее

