Картинка + текстКомпьютерное зрение

Florence-2

Очень маленькая модель зрения: подписи, поиск объектов, сегментация и чтение текста по одной команде. Работает даже на процессоре.

Разработчик
Microsoft, США
Первый выпуск
июн 2024
Последний выпуск
июн 2024
Размеры
0.23B – 0.77B
Лицензия
Можно в коммерциюMIT

Какие задачи решает

  • Чтение текста на фото
  • Поиск и выделение объектов
  • Автоматические подписи к фото
  • Разметка данных для обучения

Где применяется

ПромышленностьРозницаРазметка данных

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Florence-2 base / large

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели