Donut
Читает скан документа и сразу отдаёт заполненную структуру полей, без отдельного OCR. В HR её дообучают под разбор резюме и анкет. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
Последняя открытая версия вышла в июл 2022. Семейство давно не обновлялось: это не значит, что модель не работает, но свежих исправлений и новых размеров ждать не стоит.
- Разработчик
- NAVER CLOVA, Южная Корея
- Первый выпуск
- июл 2022
- Последний выпуск
- июл 2022
- Размеры
- около 200M
- Лицензия
- Можно в коммерциюMIT
- Русский язык
- Не заявлен
- Запуск
- Через свой серверРаботает и без видеокарты
- Сферы
- Документы и бухгалтерия, HR, Финансы
Какие задачи решает
- Извлечение полей из анкет и резюме
- Разбор сканов справок и дипломов
- Определение типа входящего документа
Где применяется
Требования к железу
Версии
- donut-base-finetuned-rvlcdip, типы документов
- donut-base-finetuned-docvqa, вопросы к документу
- donut-base-finetuned-cord-v2, чеки
- donut-base
Как запустить
Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.
Частые вопросы
Можно ли использовать Donut в коммерческом проекте?
Да. Лицензия: MIT. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.
Какое железо нужно для Donut?
Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Есть версии, которые работают и без видеокарты, на обычном процессоре. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.
Поддерживает ли Donut русский язык?
В карточке модели языки не перечислены, поэтому поддержку русского обещать нельзя — её нужно проверять на ваших примерах.
Где скачать Donut и сколько это стоит?
Веса Donut лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Модели для извлечения данных по шаблону: даёте документ или скан и JSON-шаблон полей, получаете заполненный JSON. NuExtract3 (4B) заодно переводит сканы в Markdown.
ПодробнееРазбор текстаLayoutLM (v1–v3, LayoutXLM)Microsoft · СШАКоммерция с условиямиКлассические модели понимания документов: учитывают текст, его расположение на странице и картинку. Их дообучают под извлечение полей из форм и чеков. Коммерчески свободна только первая версия.
ПодробнееДокументы и OCRTrOCRMicrosoft · СШАМожно в коммерциюРаспознаёт одну строку текста, в том числе рукописного. Официальные веса только для английского, но модель часто дообучают под другие языки — есть русские версии от сообщества.
ПодробнееИсточник: huggingface.co/naver-clova-ix/donut-base. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.


