Компьютерное зрениеПоиск и RAG

SigLIP (наследник CLIP)

Модели, которые переводят картинки и текст в общее пространство: можно искать фото по словам и классифицировать изображения без обучения. CLIP от OpenAI (2021) — предшественник.

Разработчик
Google, США
Первый выпуск
сен 2023
Последний выпуск
фев 2025
Размеры
около 0.2B – 2B
Лицензия
Можно в коммерциюApache 2.0

Какие задачи решает

  • Поиск картинок по текстовому запросу
  • Автоматическая разметка и теги каталога
  • Фильтрация недопустимого контента

Где применяется

Маркетплейсы и ритейлМедиа и фотобанкиМодерация контента

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. SigLIP 2
  2. SigLIP

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели