Компьютерное зрениеПоиск и RAG
SigLIP (наследник CLIP)
Модели, которые переводят картинки и текст в общее пространство: можно искать фото по словам и классифицировать изображения без обучения. CLIP от OpenAI (2021) — предшественник.
- Разработчик
- Google, США
- Первый выпуск
- сен 2023
- Последний выпуск
- фев 2025
- Размеры
- около 0.2B – 2B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Поиск картинок по текстовому запросу
- Автоматическая разметка и теги каталога
- Фильтрация недопустимого контента
Где применяется
Маркетплейсы и ритейлМедиа и фотобанкиМодерация контента
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- SigLIP 2
- SigLIP
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Компьютерное зрениеDINOv2 / DINOv3Meta · СШАКоммерция с условиями
Базовые модели, которые превращают картинку в числовой «отпечаток». На них строят поиск похожих изображений, классификацию и сегментацию без большой разметки.
ПодробнееПоиск и RAGJina EmbeddingsJina AI · ГерманияКоммерция с условиямиСильные многоязычные эмбеддинги с длинным контекстом, v5-omni понимает текст, картинки и аудио. Свежие версии открыты только для некоммерческого использования.
Подробнее

