Детекция подделокКомпьютерное зрение

IML-ViT

Открытая модель поиска подделок в изображениях: выдаёт попиксельную маску изменённых участков. Ошибается в обе стороны, её карта — подсказка эксперту, а не доказательство подделки.

Последняя открытая версия вышла в мар 2024. Семейство давно не обновлялось: это не значит, что модель не работает, но свежих исправлений и новых размеров ждать не стоит.

Разработчик
Sichuan University и соавторы, Китай
Первый выпуск
июл 2023
Последний выпуск
мар 2024
Размеры
модель на базе Vision Transformer
Лицензия
Можно в коммерциюMIT
Запуск
Через свой серверНужна видеокарта
Сферы
Безопасность, Документы и бухгалтерия, Юристы, Наука

Какие задачи решает

  • Поиск вклеенных и затёртых фрагментов на фото
  • Проверка сканов документов на правку
  • Базовая линия при сравнении моделей поиска монтажа
  • Дообучение под свой тип документов

Где применяется

Информационная безопасностьДокументооборотЮристы и комплаенсИсследования

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
нет версий
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Обновлённые веса
  2. Код обучения
  3. IML-ViT (статья и код)

Как запустить

На своём сервереВеса скачиваются с Hugging Face, запуск — через vLLM (нагрузка и API) или llama.cpp (скромное железо). Так модель работает в закрытом контуре, без оплаты за запросы.
Сколько нужно железаПосчитайте видеопамять под нужный размер модели, контекст и число одновременных запросов.Открыть калькулятор железа

Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.

Частые вопросы

Можно ли использовать IML-ViT в коммерческом проекте?

Да. Лицензия: MIT. Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.

Какое железо нужно для IML-ViT?

Минимум: Одна видеокарта на 16–80 ГБ — средние версии. Без видеокарты модель практически не работает. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.

Поддерживает ли IML-ViT русский язык?

Для этой модели язык не важен: она работает не с текстом.

Где скачать IML-ViT и сколько это стоит?

Веса IML-ViT лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели

Детекция подделокTruForGRIP, University Federico II of Naples · ИталияТолько некоммерческое

Ищет следы монтажа и показывает картой, какие участки изображения выглядят изменёнными: подходит для сканов договоров, справок и фото документов. Ошибается в обе стороны — решение принимает человек.

Подробнее
Детекция подделокDeepfakeBenchThe Chinese University of Hong Kong, Shenzhen (SCLBD) · КитайТолько некоммерческое

Набор из десятков открытых детекторов подмены лица на видео и фото под общим кодом и с готовыми весами. Детектор ошибается в обе стороны: его вывод — повод для проверки человеком, а не доказательство подделки.

Подробнее
Детекция подделокCommunity ForensicsUniversity of Michigan · СШАМожно в коммерцию

Лёгкий детектор сгенерированных картинок, обученный на 2,7 млн примеров почти от 5000 разных генераторов. Ошибается в обе стороны: результат — повод для проверки человеком, а не доказательство.

Подробнее

Источник: github.com/SunnyHaze/IML-ViT. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.