Картинка + текстДокументы и OCR

A-Vision (Авито)

Русскоязычная модель Авито, которая понимает картинки: описывает фото, отвечает на вопросы по изображению, читает надписи. Основа Qwen2.5-VL, на русском быстрее исходной.

Разработчик
Авито Тех, Россия
Первый выпуск
окт 2025
Последний выпуск
окт 2025
Размеры
7.4B
Лицензия
Можно в коммерциюApache 2.0
Русский язык
Есть
Запуск
Через свой серверНужна видеокарта
Сферы
Торговля и маркетплейсы, Маркетинг и контент, Документы и бухгалтерия

Какие задачи решает

  • Описание товара по фото на русском
  • Проверка, что фото совпадает с описанием
  • Чтение брендов и надписей на картинках

Где применяется

Маркетплейсы и доски объявленийМодерация карточек товаровКаталоги интернет-магазинов

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
нет версий
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. A-Vision

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели