Нейросети для торговли и маркетплейсов

Для торговли открытые модели пишут описания и карточки товаров, обрабатывают фото, отвечают покупателям и помогают прогнозировать спрос. Запуск на своём сервере даёт предсказуемые расходы при большом каталоге. При выборе смотрите на качество текстов на русском, разрешение на коммерческое использование и требования к железу.

В подборке 118 семейств открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
КартинкиGGUF2025–2026

Qwen-Image

Alibaba · Китай

Генерация и редактирование картинок, в том числе с текстом на изображении. Ранние версии можно в коммерцию, свежая 2.1 — только некоммерческая.

  • Инфографика для карточек товаров
  • Правка фото по текстовой команде
  • Рекламные креативы
Размеры
7B – 20B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстRU2022–2026

YandexGPT / AliceAI

Яндекс · Россия

Модели Яндекса, обученные с нуля с упором на русский язык и российские реалии. Новая AliceAI-Foundation 80B-A3B (Apache 2.0) — только базовая модель, инструкт-версии нет: её дообучают под свои задачи. Рядом экономичная AliceAI-T5 35B-A0.6B.

  • Русскоязычный ассистент и чат-бот
  • Ответы на вопросы по базе знаний компании
  • Основа для дообучения под свою отрасль
Размеры
8B – 100B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Табличные данные2022–2026

TabPFN

Prior Labs (Университет Фрайбурга) · Германия

Готовая модель для таблиц: получает примеры строк и сразу предсказывает для новых, без долгого обучения и подбора настроек. Свободно для бизнеса только v2, новые версии некоммерческие.

  • Прогноз оттока клиентов по выгрузке из CRM
  • Скоринг заявок и лидов
  • Классификация клиентов по данным из 1С
Размеры
от единиц до сотен миллионов параметров
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Табличные данные2025–2026

Mitra

Amazon (команда AutoGluon) · США

Табличная модель Amazon, встроенная в AutoGluon: классификация и регрессия по примерам с коротким дообучением. Mitra-v2 держит больше строк и столбцов.

  • Прогноз оттока и повторных покупок
  • Скоринг заявок
  • Прогноз суммы сделки или чека
Размеры
около 76M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данные2025–2026

LimiX

Stable AI (Пекин, с Университетом Цинхуа) · Китай

Модель для таблиц, которая одна умеет классифицировать, прогнозировать числа и заполнять пропуски в данных. Лёгкая LimiX-2M работает на обычном компьютере.

  • Заполнение пропусков в выгрузках из 1С и CRM
  • Прогноз оттока и скоринг
  • Классификация клиентов и товаров
Размеры
2M – 16M и LimiX-2
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Лица2021–2026

InsightFace

InsightFace (deepinsight) · Китай

Самый распространённый открытый набор для поиска и распознавания лиц. На нём стоят многие генераторы с сохранением лица. Готовые веса некоммерческие.

  • Поиск и сравнение лиц на фото
  • Пропуск по лицу в прототипах
  • Обработка лиц как часть других ИИ-систем
Размеры
пакеты 16 МБ – 407 МБ
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ТекстRUOllama2023–2026

Qwen

Alibaba · Китай

Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.

  • Чат-бот и ассистент по базе знаний
  • Ответы на письма и обращения
  • Разбор и классификация документов
Размеры
0,6B – 2,4T-A95B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Видео2025–2026

SANA-Video

NVIDIA · США

Лёгкая и быстрая видеомодель NVIDIA. Выдаёт 720p-ролики на одной видеокарте, есть версия на 4 шага для быстрой генерации.

  • Быстрые ролики для соцсетей
  • Массовая генерация видео
  • Видео из картинки
Размеры
2B – 5B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Прогнозы2024–2026

TimesFM

Google · США

Готовая модель прогнозов Google: строит прогноз по любому временному ряду без обучения на ваших данных.

  • Прогноз продаж и спроса
  • Планирование закупок и запасов
  • Прогноз нагрузки и трафика
Размеры
200M – 500M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2025–2026

Liquid LFM

Liquid AI · США

Модели новой архитектуры для работы прямо на устройстве: быстрые на обычном процессоре и в телефоне. Есть версии для извлечения данных, RAG и инструментов, а также LFM2.5-VL для картинок и голосовая LFM2.5-Audio.

  • Ассистент на ноутбуке или телефоне без интернета
  • Извлечение данных из документов
  • Вызов инструментов в приложениях
Размеры
230M – 24B-A2B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Видео2025–2026

Wan

Alibaba · Китай

Генерация видео по тексту и по картинке. Младшая версия запускается на игровой видеокарте. После 2.2 базовые модели открыто не выходят, только прикладные: монтаж (VACE), говорящие персонажи по звуку (S2V), танцы под музыку (Dancer).

  • Короткие рекламные ролики
  • Оживление фото товара
  • Видео для соцсетей
Размеры
1,3B – 14B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Видео2024–2026

LTX-Video / LTX-2

Lightricks · Израиль

Быстрая видеомодель, которая с LTX-2 генерирует видео сразу со звуком и речью. Можно управлять камерой и позой, есть облегчённые версии.

  • Рекламные ролики со звуком
  • Видео из фото товара
  • Озвученные сцены для соцсетей
Размеры
2B – 22B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

LongCat

Meituan · Китай

Модели Meituan (крупнейший сервис доставки Китая). LongCat-Flash динамически меняет объём вычислений под сложность запроса; LongCat-2.0 — 1,6 трлн параметров под MIT. Есть омни-модели (Flash-Omni, Next) и синтез речи AudioDiT.

  • Агенты для заказов и сервисных процессов
  • Корпоративный ассистент
  • Разбор длинных документов
Размеры
1B – 1.6T-A48B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютераGGUF2025–2026

Fara

Microsoft · США

Небольшие модели Microsoft для работы в браузере: смотрят на страницу и кликают, печатают, прокручивают. Рассчитаны на запуск прямо на рабочем компьютере без облака.

  • Заполнение веб-форм и заявок
  • Сбор данных из веб-кабинетов без API
  • Проверка сайтов по сценарию
Размеры
4B – 27B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
РеранкерыGGUF2024–2026

Jina Reranker

Jina AI · Германия

Сильные многоязычные реранкеры; m0 сортирует и страницы-картинки (сканы, слайды). Свежие версии открыты только для некоммерческого использования.

  • Уточнение выдачи перед ответом чат-бота
  • Сортировка найденных страниц PDF и слайдов
  • Поиск по каталогу и базе знаний
Размеры
33M – 2.4B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

Gemma

Google · США

Компактные модели Google: хорошо работают на одном компьютере, старшие версии понимают картинки. Есть CodeGemma для кода, FunctionGemma 270M для вызова функций и быстрая DiffusionGemma.

  • Ассистент на ноутбуке без интернета
  • Разбор фото документов и чеков
  • Классификация обращений
Размеры
270M – 31B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2026

Krea 2

Krea · США

Модель картинок на 12B с упором на реализм без глянцевого «ИИ-вида». Turbo-версия выдаёт 2K-картинку за пару секунд.

  • Реалистичные фото для рекламы
  • Картинки высокого разрешения
  • Дообучение стилей
Размеры
12B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Компьютерное зрение2025–2026

RF-DETR

Roboflow · США

Детектор объектов в реальном времени, открытая замена YOLO без AGPL. Умеет сегментацию (контуры объектов), с 2026 года — ключевые точки.

  • Детекция объектов на видео и фото
  • Точные контуры деталей и дефектов
  • Дообучение под свои классы объектов
Размеры
Nano – 2XL
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Прогнозы2025–2026

TiRex

NXAI · Австрия

Компактная модель прогнозов на архитектуре xLSTM, лидер открытых тестов при малом размере. Быстро работает на обычном процессоре.

  • Прогноз спроса и продаж
  • Прогноз потребления энергии
  • Прогнозы на слабом железе и на месте
Размеры
около 35M – 82M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстOllama2024–2026

Moondream

Moondream (M87 Labs) · США

Небольшая и быстрая модель зрения для продуктовых задач: ответы на вопросы, поиск и указание объектов, подписи. Moondream 3.1 — MoE на 9B с 2B активных.

  • Поиск объектов и подсчёт на фото
  • Проверка фото из полевых отчётов
  • Подписи и теги для каталога
Размеры
2B – 9B-A2B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Документы и OCRRU2022–2026

PP-OCR и PP-DocLayout (классический PaddleOCR)

Baidu (PaddlePaddle) · Китай

Классические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.

  • Распознавание текста на сканах, фото и экранах
  • Чтение этикеток, табло, маркировки на производстве и складе
  • Разметка страниц: таблицы, формулы, печати, заголовки
Размеры
от 1.5M до десятков миллионов параметров
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2025–2026

HiDream

HiDream.ai · Китай

Открытые модели картинок под MIT: генерация (I1), редактирование по инструкции (E1) и единая модель O1-Image, которая делает и то и другое.

  • Генерация картинок по описанию
  • Правка изображений словами
  • Вариации продуктовых фото
Размеры
около 9B – 17B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
3D2024–2026

TripoSR / TripoSG

VAST (TripoSR — вместе со Stability AI) · Китай

Семейство VAST: 3D-модель по одной фотографии. TripoSR работает меньше секунды, TripoSG даёт более чистую геометрию, TripoSplat строит сцену из гауссовых точек.

  • 3D-модель товара по фото
  • Заготовки объектов для игр и AR
  • Быстрый 3D-прототип для печати
Размеры
до 1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUGGUF2023–2026

Jina Embeddings

Jina AI · Германия

Сильные многоязычные эмбеддинги с длинным контекстом, v5-omni понимает текст, картинки и аудио. Свежие версии открыты только для некоммерческого использования.

  • Поиск по документам на многих языках
  • Поиск по картинкам и сканам
  • Классификация и кластеризация
Размеры
33M – 3.8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ПереводRU2025–2026

Hunyuan-MT / Hy-MT

Tencent · Китай

Переводчики Tencent на 33 языка, первая версия победила на соревновании WMT25. Русский есть. Малая версия 1.8B работает на ноутбуке, свежая Hy-MT2 под Apache 2.0.

  • Перевод документов с сохранением форматирования
  • Перевод с заданным глоссарием терминов
  • Перевод переписки с китайскими партнёрами
Размеры
1.8B – 30B-A3B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Обработка фото2023–2026

BRIA RMBG

BRIA AI · Израиль

Удаление фона от BRIA, обучено на лицензированных фото. Мягкие края, волосы, прозрачность. Есть версии для видео. Для бизнеса нужен платный договор.

  • Вырезка товара на белый фон
  • Фото сотрудников и экспертов без фона
  • Удаление фона на видео
Размеры
44M – 220M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Картинка + текстOllama2023–2026

LLaVA

LLaVA / LMMs-Lab (исследователи из США и Китая) · США / Китай

Открытый проект, с которого пошла мода на модели «картинка + текст». Линейка OneVision понимает фото, документы и видео; открыты данные и рецепты обучения.

  • Ответы на вопросы по фото и скриншотам
  • Описание товаров по фотографии
  • Разбор видео по кадрам
Размеры
0.5B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстOllama2024–2026

MiniCPM-V

OpenBMB (ModelBest и Университет Цинхуа) · Китай

Компактные модели зрения, которые работают даже на телефоне и ноутбуке. Хорошо читают текст на фото, понимают видео; версия 4.6 весит всего 1.3B.

  • Распознавание текста на фото прямо на устройстве
  • Разбор чеков и документов без отправки в облако
  • Описание фото и видео
Размеры
1.3B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютераGGUF2025–2026

Holo

H Company · Франция

Французское семейство моделей для управления браузером и компьютером: точно находит нужный элемент на экране и ведёт многошаговые задачи. Свежие Holo3 и 3.1 открыты под Apache 2.0.

  • Работа в веб-кабинетах и старых программах без API
  • Заполнение форм и заявок
  • Проверка интерфейсов по сценарию
Размеры
0.8B – 235B-A22B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Компьютерное зрение2024–2026

Sapiens

Meta · США

Модели Meta для анализа человека на фото: ключевые точки позы, разметка частей тела, нормали и глубина. Sapiens2 обучены на высоком разрешении и добавили маттинг людей.

  • Определение позы и ключевых точек тела
  • Разметка частей тела и одежды
  • Отделение человека от фона
Размеры
0.1B – 5B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Прогнозы2024–2026

Timer (THUML)

THUML, Университет Цинхуа · Китай

Компактная базовая модель прогнозов от лаборатории Цинхуа: обучена на большом наборе разнородных рядов и дообучается под свои данные.

  • Прогноз спроса и нагрузки
  • Прогноз показаний датчиков на производстве
  • Дообучение прогноза под свою историю
Размеры
84M (timer-base)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

ERNIE 4.5

Baidu · Китай

Первая открытая линия Baidu: от крошечной 0.3B до MoE на 424 млрд параметров, есть версии с пониманием картинок. Средняя 21B-A3B помещается на одну видеокарту; ERNIE-Image 8B рисует картинки с текстом.

  • Корпоративный ассистент
  • Разбор документов и изображений
  • Классификация обращений
Размеры
0.3B – 424B-A47B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRU2020–2026

OPUS-MT (MarianMT)

Helsinki-NLP, Хельсинкский университет · Финляндия

Более тысячи маленьких переводчиков, каждый под свою пару языков. Есть русский-английский и обратно. Работают быстро даже на обычном процессоре.

  • Массовый перевод коротких текстов
  • Перевод прямо на сервере без видеокарты
  • Перевод отзывов и заявок перед анализом
Размеры
25M – 240M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютера2024–2026

ShowUI

Show Lab (Национальный университет Сингапура) · Сингапур

Лёгкая модель для работы с интерфейсом: находит кнопки и поля по описанию и выполняет действия в вебе и на телефоне. ShowUI-π умеет перетаскивание мышью.

  • Клики и заполнение форм по описанию задачи
  • Автотесты веб-интерфейсов
  • Помощник на слабом компьютере без облака
Размеры
2B (ShowUI), около 500M (ShowUI-π)
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Разбор текстаOllama2024–2026

NuExtract

NuMind · Франция

Модели для извлечения данных по шаблону: даёте документ или скан и JSON-шаблон полей, получаете заполненный JSON. NuExtract3 (4B) заодно переводит сканы в Markdown.

  • Извлечение реквизитов, сумм и дат из счетов и договоров в JSON
  • Разбор чеков, накладных и анкет по заданному шаблону
  • Перевод сканов в Markdown для поиска
Размеры
0.5B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Компьютерное зрение2023–2026

Segment Anything (SAM)

Meta · США

Выделяет любой объект на фото и видео по клику или рамке. Основа для удаления фона и подсчёта объектов.

  • Удаление фона с фото товара
  • Подсчёт объектов на фото
  • Разметка данных для обучения
Размеры
91M – ~0,85B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2025–2026

Reka Flash и Reka Edge

Reka AI · США

Компактные модели Reka: Flash 3 на 21B для рассуждений и Reka Edge на 7B, которая быстро разбирает изображения и видео на устройстве.

  • Разбор фото и видео (Edge)
  • Поиск объектов на изображениях
  • Задачи с рассуждением (Flash)
Размеры
7B – 21B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Табличные данные2025–2026

Orion-MSP / Orion-BiX

Lexsi Labs · Индия

Свежие открытые модели для табличных данных: предсказывают по нескольким примерам прямо в запросе, без обучения под конкретную задачу.

  • Классификация и прогноз по таблицам без отдельного обучения
  • Быстрая проверка моделей на новых наборах данных
  • Оценка признаков в больших таблицах
Размеры
размер не указан в карточке
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2025–2026

LongCat-Image

Meituan · Китай

Модель генерации и редактирования картинок на 6B от Meituan. Хорошо пишет китайский текст, есть быстрая версия для правок.

  • Генерация картинок по описанию
  • Правка фото по инструкции
  • Визуалы для карточек товаров
Размеры
6B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Голосовые ассистентыGGUF2025–2026

MiniCPM-o

OpenBMB (ModelBest, Университет Цинхуа) · Китай

Небольшая модель, которая видит, слышит и отвечает голосом в реальном времени, может клонировать голос. Голосовой диалог на английском и китайском, текст — на 30+ языках.

  • Голосовой ассистент на своём сервере
  • Разбор видео и документов
  • Ответы голосом по картинке с камеры
Размеры
8B – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одежды2026

FASHN VTON

FASHN AI · Израиль

Редкая открытая примерка с коммерческой лицензией: без маски, берёт фото вещи на модели или раскладку. Веса около 2 ГБ.

  • Карточки товара на модели без фотосессии
  • Примерочная на сайте магазина
  • Каталог из фото раскладки одежды
Размеры
972M
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Агенты для компьютера2025–2026

GUI-Owl / Mobile-Agent

Alibaba (Tongyi Lab, X-PLUG) · Китай

Модели для управления телефоном и компьютером из проекта Mobile-Agent: работают с Android, Windows, macOS и браузером, в версии 1.5 есть режим с рассуждением.

  • Автоматизация действий в мобильных приложениях
  • Работа в настольных программах без API
  • Тестирование приложений по сценарию
Размеры
2B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данные2025–2026

TabICL

Inria (команда Soda) · Франция

Открытая табличная модель от создателей scikit-learn: без обучения классифицирует и прогнозирует по примерам, тянет таблицы до сотен тысяч строк. Лицензия разрешает бизнес.

  • Прогноз оттока клиентов
  • Скоринг заявок и сделок
  • Классификация клиентов по данным из 1С и CRM
Размеры
около 25–30M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2024–2026

FLUX

Black Forest Labs · Германия

Генерация картинок от авторов Stable Diffusion. Хорошо рисует текст на изображении и держит композицию.

  • Картинки для карточек товаров
  • Баннеры и обложки
  • Редактирование фото по описанию (Kontext)
Размеры
4B – 32B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
КартинкиGGUF2025–2026

Z-Image

Alibaba (Tongyi-MAI) · Китай

Компактная модель на 6B с фотореализмом уровня крупных моделей. Turbo-версия выдаёт картинку за несколько шагов на обычной игровой видеокарте.

  • Фотореалистичные рекламные картинки
  • Картинки с текстом на английском и китайском
  • Массовая генерация визуалов
Размеры
6B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
АватарыGGUF2025–2026

Live Avatar

Alibaba (Quark) · Китай

Потоковый аватар в реальном времени неограниченной длины. Подходит для живых эфиров и диалога, но требует мощного серверного железа.

  • Живой аватар для диалога с клиентом
  • Бесконечные трансляции с ведущим
  • Интерактивные персонажи
Размеры
14B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Компьютерное зрение2023–2026

YOLO (Ultralytics)

Ultralytics · США

Самый распространённый детектор объектов в реальном времени: находит и выделяет предметы на видео даже на слабом железе. YOLOv5 вышел ещё в 2020, в каталоге отсчёт от YOLOv8.

  • Подсчёт людей, машин, товаров на видео
  • Контроль касок и спецодежды
  • Поиск брака на конвейере
Размеры
2.4M – 68M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ПереводRUOllama2026

TranslateGemma

Google · США

Переводчики на базе Gemma 3 на 55 языков, умеют переводить и текст на картинках. Русский есть. Версия 4B помещается на ноутбук.

  • Перевод документов и переписки
  • Перевод текста со скриншотов и фото
  • Локализация сайтов и приложений
Размеры
4B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
3DGGUF2024–2025

TRELLIS

Microsoft · США

Одна из сильнейших открытых 3D-моделей: по картинке или тексту выдаёт сетку с текстурой или гауссову сцену. TRELLIS.2 заметно детальнее первой версии.

  • 3D-модели товаров и интерьера по фото
  • Ассеты для игр и AR/VR
  • Прототипы для 3D-печати
Размеры
до 4B (TRELLIS.2)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Агенты для компьютера2023–2025

CogAgent / AutoGLM

Zhipu AI (Z.ai) и Университет Цинхуа · Китай

Одна из первых открытых моделей для управления интерфейсом по скриншоту, развитие — AutoGLM-Phone для работы в приложениях смартфона на Android.

  • Автоматизация действий в мобильных приложениях
  • Работа в веб-интерфейсах без API
  • Тестирование приложений по сценарию
Размеры
9B – 18B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Компьютерное зрение2025

Perception Encoder (PE)

Meta · США

Семейство энкодеров Meta для картинок и видео, а с версией PE-AV — и для звука. PE-Core ищет по тексту точнее SigLIP 2 (по данным Meta), есть малые версии.

  • Поиск фото и видео по описанию
  • Разметка и теги каталога
  • Поиск по звуку и видео (PE-AV)
Размеры
размер на карточке не указан
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данныеGGUF2024–2025

TableGPT2 / TableGPT-R1

Чжэцзянский университет · Китай

Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.

  • Ответы на вопросы по таблицам и выгрузкам
  • Автоматический разбор данных с написанием кода
  • Помощник в BI и внутренней отчётности
Размеры
7B – 72B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
3DGGUF2025

SAM 3D

Meta · США

Восстанавливает 3D-форму предмета или тела человека по одной обычной фотографии, даже если объект частично закрыт. Две модели: Objects и Body.

  • 3D-модель предмета с фото из каталога
  • Оценка позы и формы тела по фото
  • Примерка и AR-сценарии
Размеры
н/д
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Компьютерное зрение2023–2025

MetaCLIP / MetaCLIP 2

Meta · США

Открытый повтор CLIP от Meta с прозрачным рецептом сбора данных. MetaCLIP 2 обучен на многоязычных данных со всего мира. Только некоммерческая лицензия.

  • Поиск картинок по тексту
  • Классификация изображений без обучения
  • Исследования и прототипы поиска
Размеры
0.15B – 3.6B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ВидеоGGUF2025

LongCat-Video

Meituan · Китай

Видеомодель на 13.6B: из текста, из картинки и продолжение видео. Держит качество на роликах в несколько минут.

  • Длинные ролики
  • Видео из фото
  • Продолжение готового видео
Размеры
13.6B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Компьютерное зрение2023–2025

Grounding DINO / Rex-Omni

IDEA Research · Китай

Находит на картинке любые объекты по текстовому описанию, без обучения на своих данных: «красная коробка», «человек без каски». Rex-Omni — новое поколение на базе VLM.

  • Поиск объектов по описанию без разметки
  • Автоматическая разметка данных для обучения
  • Проверка фото на соответствие требованиям
Размеры
172M – 3B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ПрогнозыGGUF2024–2025

Chronos

Amazon · США

Модели прогнозов Amazon, одни из самых скачиваемых. Chronos-2 учитывает внешние факторы: цены, акции, погоду.

  • Прогноз спроса с учётом акций и цен
  • Планирование запасов
  • Прогноз выручки и потоков клиентов
Размеры
8M – 710M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстOllama2023–2025

Qwen-VL

Alibaba (команда Qwen) · Китай

Одна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.

  • Извлечение данных из сканов счетов и накладных
  • Разбор фотографий товаров и витрин
  • Анализ видео и записей с камер
Размеры
2B – 235B-A22B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2025

mxbai (Mixedbread Embed и Rerank)

Mixedbread · Германия

Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.

  • Поиск по базе знаний
  • Переранжирование результатов перед ответом бота
  • Поиск по каталогу товаров
Размеры
17M – 1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2025

A-Vibe (Авито)

Авито Тех · Россия

Модель Авито на базе Qwen3-8B, переученная под русский язык: свой токенизатор, русские тексты быстрее на 15–25%. Умеет вызывать функции.

  • Описания товаров и объявлений на русском
  • Чат-бот с вызовом внутренних сервисов
  • Разбор и классификация обращений
Размеры
7.9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстRU2025

A-Vision (Авито)

Авито Тех · Россия

Русскоязычная модель Авито, которая понимает картинки: описывает фото, отвечает на вопросы по изображению, читает надписи. Основа Qwen2.5-VL, на русском быстрее исходной.

  • Описание товара по фото на русском
  • Проверка, что фото совпадает с описанием
  • Чтение брендов и надписей на картинках
Размеры
7.4B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
3D2024–2025

Hunyuan3D

Tencent · Китай

Открытая 3D-линейка Tencent: форма и текстура по картинке, качество на уровне платных сервисов. Omni добавляет управление позой и формой, Part делит модель на детали.

  • 3D-модели товаров с текстурой
  • Персонажи и предметы для игр
  • Разделение модели на детали для печати
Размеры
набор моделей: форма и текстуры
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Голосовые ассистентыRUGGUF2025

Qwen Omni

Alibaba (Qwen) · Китай

Модели, которые понимают текст, картинки, аудио и видео и отвечают голосом в реальном времени. Qwen3-Omni говорит на 10 языках, включая русский.

  • Голосовой ассистент для клиентов
  • Разбор звонков и видео
  • Ответы голосом по документам и картинкам
Размеры
3B – 30B-A3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLGGUF2024–2025

Prem-1B-SQL

Prem AI · Великобритания

Модель текст-в-SQL всего на 1B параметров: задумана для локального запуска, чтобы база данных не уходила во внешние сервисы.

  • Локальный перевод вопросов в SQL без выхода в интернет
  • Подсказки по запросам на слабом железе
  • Встраивание в внутренние инструменты аналитики
Размеры
1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПрогнозыGGUF2024–2025

Moirai

Salesforce · США

Универсальная модель прогнозов Salesforce для рядов с разной частотой и многими переменными. Веса открыты только для исследований.

  • Исследовательские пилоты прогнозов
  • Сравнение с другими моделями прогнозов
  • Прогнозы по многим связанным рядам
Размеры
11M – 311M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Примерка одежды2025

OmniTry

Kunbyte AI · Китай

Примерка не только одежды: очки, серьги, сумки, шляпы, часы и другие аксессуары. Работает без маски. Требует видеокарту от 28 ГБ.

  • Примерка аксессуаров и украшений на фото
  • Карточки товара с аксессуаром на модели
  • Примерочная очков и бижутерии на сайте
Размеры
дополнение к FLUX.1 Fill dev 12B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Примерка одежды2025

FastFit

LavieAI и Университет Сунь Ятсена · Китай

Примерка сразу нескольких вещей за раз: верх, низ, обувь, сумка. Быстрее прежних моделей за счёт кэширования. Лицензия некоммерческая.

  • Сборка образа из нескольких товаров на одной модели
  • Пилот «собери лук» на сайте
  • Прототипы лукбуков без съёмки
Размеры
на базе SD 1.5 inpainting
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Обработка фотоGGUF2024–2025

BiRefNet

Нанькайский университет · Китай

Открытая модель точного выделения объекта и удаления фона под лицензией MIT. На ней построен RMBG-2.0. Есть версии для 2K и для волос и полупрозрачных краёв.

  • Удаление фона с фото товаров потоком
  • Точные маски для дизайна и печати
  • Вырезка людей с волосами для рекламы
Размеры
около 220M (есть облегчённые lite)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2024–2025

OmniGen

BAAI (Пекинская академия ИИ) · Китай

Универсальная модель: генерирует, редактирует, переносит объект или человека с фото в новую сцену без отдельных плагинов.

  • Перенос товара или человека в новую сцену
  • Редактирование фото по инструкции
  • Генерация по нескольким референсам
Размеры
около 4B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Обработка фото2025

SeedVR / SeedVR2

ByteDance Seed · Китай

Восстановление и увеличение видео и фото от ByteDance. SeedVR2 делает это за один шаг, поэтому заметно быстрее похожих моделей. Коммерческая лицензия.

  • Увеличение фото и видео до 2K–4K
  • Восстановление старых роликов и снимков
  • Улучшение пользовательских фото перед публикацией
Размеры
3B – 7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Текст в SQLGGUF2025

SQL-R1

IDEA Research · Китай

Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.

  • Запросы к базе по вопросам с несколькими условиями
  • Разбор и исправление чужих SQL-запросов
  • Помощник аналитика в BI-системе
Размеры
3B – 14B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2025

BAGEL

ByteDance Seed · Китай

Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.

  • Редактирование фото в диалоге
  • Ответы на вопросы по изображению
  • Генерация картинок с пояснениями
Размеры
14B-A7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Текст в SQL2025

Arctic-Text2SQL-R1

Snowflake · США

Модель Snowflake для перевода вопросов в SQL, обученная с подкреплением на проверке результата запроса. Открыта версия 7B на базе Qwen2.5-Coder.

  • Вопросы к хранилищу данных на обычном языке
  • Генерация SQL для отчётов и дашбордов
  • Проверка и исправление запросов аналитиков
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Прогнозы2025

Sundial

THUML, Университет Цинхуа · Китай

Модель прогнозов, которая выдаёт не одну линию, а набор возможных сценариев — удобно, когда нужен коридор спроса или нагрузки, а не одно число.

  • Прогноз спроса с коридором значений
  • Планирование запасов с учётом разброса
  • Прогноз нагрузки на сервисы и персонал
Размеры
128M (sundial-base)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одежды2024–2025

CatVTON / CatV2TON

Университет Сунь Ятсена и Pixocial · Китай

Лёгкая модель примерки, запускается на обычной видеокарте. Есть версия без маски и CatV2TON, который примеряет одежду и на видео.

  • Примерка вещи на фото покупателя
  • Черновые карточки товара на модели
  • Примерка на коротком видео
Размеры
899M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Картинка + текстGGUF2024–2025

SmolVLM

Hugging Face · Франция / США

Самые маленькие модели зрения Hugging Face: от 256M, работают в браузере и на телефоне. SmolVLM2 понимает и видео.

  • Описание фото и видео на слабом железе
  • Чтение простых документов
  • Встраивание в мобильные и офлайн-приложения
Размеры
256M – 2.2B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQL2025

XiYanSQL-QwenCoder

Alibaba · Китай

Модели Alibaba для перевода вопросов в SQL на базе Qwen2.5-Coder. Работают с разными диалектами SQL, есть малая версия 3B для слабого железа.

  • Вопросы к базе на обычном языке
  • Запросы к разным СУБД (PostgreSQL, MySQL, SQLite)
  • Автоматизация типовых отчётов
Размеры
3B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Модерация и безопасность2023–2025

NSFW-классификаторы (Falconsai, Freepik)

Falconsai и Freepik · США и Испания

Небольшие модели, которые отличают откровенные картинки от обычных. Freepik различает четыре уровня откровенности. Работают на процессоре.

  • Фильтр пользовательских фото и аватаров
  • Проверка картинок от генераторов перед публикацией
  • Разметка медиатеки
Размеры
86M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2024–2025

SANA

NVIDIA · США

Быстрая модель картинок от NVIDIA: 4K-изображения за секунды и работа даже на ноутбучной видеокарте. Версия Sprint генерирует в 1–2 шага.

  • Массовая генерация картинок
  • Визуалы высокого разрешения
  • Генерация в реальном времени в приложениях
Размеры
0.6B – 4.8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQL2025

OmniSQL

Renmin University of China (RUC) · Китай

Модели для перевода вопросов в SQL, обученные на миллионах синтетических примеров запросов к разным базам. Три размера под разное железо.

  • Вопросы к базе данных без знания SQL
  • Генерация запросов для отчётов
  • Основа для дообучения под свою схему базы
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Компьютерное зрение2023–2025

SigLIP (наследник CLIP)

Google · США

Модели, которые переводят картинки и текст в общее пространство: можно искать фото по словам и классифицировать изображения без обучения. CLIP от OpenAI (2021) — предшественник.

  • Поиск картинок по текстовому запросу
  • Автоматическая разметка и теги каталога
  • Фильтрация недопустимого контента
Размеры
около 0.2B – 2B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одежды2025

Any2AnyTryon

Пекинский университет почты и связи и др. · Китай

Универсальный набор для одежды на базе FLUX: примерка, генерация модели в заданной вещи и «снятие» вещи с человека в отдельное фото товара.

  • Примерка по фото товара
  • Фото модели в вещи по текстовому описанию
  • Чистое фото вещи со снимка человека
Размеры
дополнения (LoRA) к FLUX.1 dev 12B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
3D2024–2025

Stable Fast 3D / SPAR3D

Stability AI · Великобритания

Модели Stability AI, которые за секунду превращают одну фотографию в 3D-модель с текстурой. SPAR3D позволяет поправить форму через облако точек.

  • 3D-карточки товаров по фото
  • Ассеты для игр и AR
  • Быстрые макеты для дизайна
Размеры
1B – 2B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Обработка фото2024–2025

BEN2

Prama LLC · США

Модель удаления фона с упором на сложные края: волосы, мех, тонкие детали. Открытая версия под MIT, умеет обрабатывать видео.

  • Вырезка товара и людей с фото
  • Удаление фона на видео
  • Подготовка фото для каталога
Размеры
около 95M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2019–2025

Sentence Transformers (all-MiniLM, paraphrase-multilingual)

UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия

Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.

  • Поиск по базе знаний и FAQ
  • Поиск похожих обращений и дублей
  • Группировка отзывов и заявок по темам
Размеры
около 20M – 470M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одежды2024

Leffa

Meta AI (вместе с King's College London) · США

Модель Meta для примерки и смены позы человека на фото. Бережно переносит мелкие детали ткани и надписи. Лицензия MIT, но обучающие данные некоммерческие.

  • Примерка одежды на фото модели
  • Смена позы модели на уже снятом кадре
  • Добор ракурсов для карточки товара
Размеры
на базе Stable Diffusion
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Примерка одежды2024

FitDiT

Tencent и Фуданьский университет · Китай

Примерка на трансформере от Tencent: точнее передаёт фактуру ткани, мелкий принт и длину вещи. Лицензия некоммерческая.

  • Примерка вещей со сложным принтом и фактурой
  • Карточки товара на модели для тестов
  • Подбор длины и посадки на фото
Размеры
на базе SD3
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Поиск по сканам документов2024

GME (General Multimodal Embedding)

Alibaba (Tongyi Lab) · Китай

Один вектор и для текста, и для картинки, и для их пары: одной моделью можно искать товар по фото, страницу документа по вопросу и картинку по описанию. Языки в карточке: английский и китайский.

  • Поиск товара по фотографии
  • Поиск по каталогу картинок и карточек
  • Поиск по страницам документов как по изображениям
Размеры
2B и 7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
КартинкиGGUF2022–2024

Stable Diffusion

Stability AI · Великобритания

Модель, с которой началась открытая генерация картинок. Огромная экосистема дообучений, стилей и плагинов, работает даже на домашнем ПК. Популярные ускорители SDXL-Lightning и Hyper-SD сделала ByteDance.

  • Иллюстрации и баннеры для рекламы
  • Фоны и сцены для карточек товаров
  • Дообучение под фирменный стиль
Размеры
0.9B – 8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск по сканам документов2024

VLM2Vec

TIGER-Lab · Канада

Превращает модель «картинка плюс текст» в модель эмбеддингов: один вектор для страницы, схемы или фото с подписью. В карточке заявлен английский язык.

  • Поиск по смешанному архиву текстов и картинок
  • Поиск по страницам документов как по изображениям
  • Подбор похожих карточек и иллюстраций
Размеры
около 4B (на базе Phi-3.5-V)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Прогнозы2024

MOMENT

Auton Lab, Университет Карнеги — Меллона · США

Базовая модель для рядов чисел: один движок используют и для прогноза, и для поиска аномалий, и для заполнения пропусков, и для классификации.

  • Прогноз спроса и загрузки
  • Поиск аномалий в показаниях датчиков и метриках
  • Заполнение пропусков в исторических данных
Размеры
около 40M – 385M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Прогнозы2024

Granite Time Series (TinyTimeMixers, PatchTST)

IBM Research · США

Крошечные модели прогнозов от IBM: считаются на обычном процессоре, их ставят рядом с бизнес-системой без отдельного сервера с видеокартой.

  • Прогноз продаж и остатков на складе
  • Прогноз энергопотребления и нагрузки оборудования
  • Быстрые прогнозы прямо на сервере компании
Размеры
очень маленькие: у TinyTimeMixers около 1M параметров
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Прогнозы2024

Time-MoE

Команда Time-MoE · не раскрыта

Модель прогнозов с разреженной архитектурой: на каждом шаге работает лишь часть сети, поэтому она остаётся быстрой при небольшом размере.

  • Прогноз продаж и остатков
  • Прогноз нагрузки на сервисы и персонал
  • Планирование закупок по истории
Размеры
50M и 200M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данныеНе развивается2024

TabuLa-8B

ML Foundations · США

Базовая модель для предсказаний по таблицам: делает классификацию и прогноз по нескольким примерам, без отдельного обучения под задачу.

  • Классификация записей в таблице по нескольким примерам
  • Прогноз значения по строке данных
  • Быстрая проверка гипотез на новых наборах данных
Размеры
8B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Картинка + текстНе развивается2024

Florence-2

Microsoft · США

Очень маленькая модель зрения: подписи, поиск объектов, сегментация и чтение текста по одной команде. Работает даже на процессоре.

  • Чтение текста на фото
  • Поиск и выделение объектов
  • Автоматические подписи к фото
Размеры
0.23B – 0.77B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Обработка фотоНе развивается2023–2024

PowerPaint

Shanghai AI Laboratory (OpenMMLab) и Университет Цинхуа · Китай

Универсальная дорисовка фото: убрать объект, вставить новый по описанию, заменить форму или расширить кадр за края.

  • Удаление и замена объектов на фото
  • Расширение кадра под нужный формат
  • Вставка товара или детали по текстовому описанию
Размеры
на базе SD 1.5
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Обработка фотоНе развивается2024

IC-Light

Лвмин Чжан (автор ControlNet) · США

Меняет освещение на фото: ставит объект или человека в новый свет по описанию или под заданный фон, чтобы вырезка смотрелась естественно.

  • Подгонка света товара под новый фон
  • Студийный свет для портретов без пересъёмки
  • Единый стиль освещения в каталоге
Размеры
на базе SD 1.5
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLOllamaНе развивается2023–2024

SQLCoder

Defog · США

Одна из первых открытых моделей, которые переводят вопрос на обычном языке в SQL-запрос к базе. Есть в Ollama, но свежие конкуренты уже сильнее.

  • Ответы на вопросы менеджеров по базе продаж без аналитика
  • Черновики SQL-запросов для отчётов
  • Помощник внутри BI-системы
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
3DНе развивается2024

InstantMesh

Tencent ARC · Китай

Делает 3D-сетку по одной картинке примерно за 10 секунд: сначала рисует объект с нескольких ракурсов, потом собирает из них модель.

  • 3D-модель объекта по фото
  • Заготовки для игр и визуализаций
  • Прототипы для 3D-печати
Размеры
н/д
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Примерка одеждыНе развивается2024

IDM-VTON

KAIST и OMNIOUS.AI · Южная Корея

Одна из самых известных открытых примерок: переносит вещь с фото товара на фото человека, хорошо держит принты и логотипы. Лицензия некоммерческая.

  • Пилот примерочной на сайте магазина
  • Прототип карточек товара на модели без фотосессии
  • Сравнение с коммерческими сервисами примерки
Размеры
на базе SDXL
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Текст в SQLGGUFНе развивается2024

Chat2DB-SQL

Chat2DB · Китай

Модель текст-в-SQL из открытого инструмента работы с базами Chat2DB: поддерживает разные диалекты SQL, карточка на английском и китайском.

  • Перевод вопроса в SQL внутри клиента базы данных
  • Черновики запросов под разные СУБД
  • Подсказки разработчику при работе со схемой
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одеждыНе развивается2024

OOTDiffusion

Xiao-i Research · Китай

Ранняя популярная открытая примерка: одна версия для верхней одежды по пояс, другая для образа в полный рост. Лицензия некоммерческая.

  • Примерка верха на фото модели
  • Примерка в полный рост: верх, низ, платья
  • Прототип примерочной для тестов
Размеры
на базе Stable Diffusion
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
КартинкиНе развивается2023–2024

Playground

Playground AI · США

Модель на архитектуре SDXL с упором на эстетику: яркие цвета, контраст, портреты. Совместима с инструментами экосистемы SDXL.

  • Эстетичные рекламные визуалы
  • Портреты и лайфстайл-картинки
  • Обложки для постов
Размеры
около 2.6B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Поиск и RAGRUНе развивается2022–2024

E5 / multilingual-e5

Microsoft · США

Проверенные модели для смыслового поиска. Многоязычные версии хорошо работают с русским и до сих пор служат надёжной основой для RAG.

  • Поиск по базе знаний и документам
  • Подбор ответов для чат-бота (RAG)
  • Поиск похожих обращений и дублей
Размеры
33M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одеждыНе развивается2024

StableVITON

KAIST · Южная Корея

Исследовательская модель примерки с конференции CVPR 2024, одна из первых на базе Stable Diffusion. Сейчас чаще служит точкой сравнения.

  • Пилот примерки верхней одежды
  • Сравнение качества разных моделей примерки
  • Обучение своей примерки на базе открытого кода
Размеры
на базе Stable Diffusion
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Текст в SQLGGUFНе развивается2024

Natural-SQL

ChatDB · США

Модель текст-в-SQL на базе DeepSeek-Coder, рассчитанная на сложные вопросы с несколькими таблицами и условиями.

  • Сложные запросы с соединением нескольких таблиц
  • Ответы на вопросы по базе без аналитика
  • Черновики SQL для отчётов и выгрузок
Размеры
7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ВидеоНе развивается2023

Stable Video Diffusion

Stability AI · Великобритания

Первая открытая модель Stability AI для видео: оживляет фото в ролик на 2–4 секунды. Сейчас уступает новым моделям по качеству.

  • Оживление фото товара
  • Короткие видеозаставки
  • Анимация иллюстраций
Размеры
около 1.5B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Текст в SQLНе развивается2023

CodeS

RUCKBReasoning, Китайский народный университет · Китай

Ранняя линейка открытых моделей текст-в-SQL размером от 1B: есть варианты, дообученные под конкретные схемы баз данных.

  • Перевод вопроса сотрудника в SQL-запрос
  • Черновики запросов к хранилищу под отчёт
  • Встраивание в BI-панель как подсказчик
Размеры
1B – 15B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Обработка фотоНе развивается2022–2023

InSPyReNet / transparent-background

Ким Тэхун (POSTECH) · Южная Корея

Модель выделения главного объекта и готовая программа transparent-background на её основе: убирает фон с фото, видео и веб-камеры одной командой.

  • Пакетное удаление фона с фото
  • Замена фона на цвет или размытие
  • Удаление фона на видео
Размеры
небольшая (на базе Swin-B)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Обработка фотоНе развивается2022–2023

HAT

XPixel Group (Шэньчжэньский институт передовых технологий АН Китая и др.) · Китай

Увеличение фото на трансформере, точнее SwinIR на тонких деталях. Есть версии для реальных снимков с шумом и лёгкая HAT-S.

  • Увеличение фото товаров и интерьеров
  • Подготовка изображений к печати
  • Повышение чёткости архивных снимков
Размеры
9M – 40M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLGGUFНе развивается2023

NSQL

Numbers Station · США

Одна из первых открытых линеек текст-в-SQL, включая совсем маленькие версии от 350M, которые запускаются на обычном ПК.

  • Перевод вопроса в SQL по описанию таблиц
  • Подсказки при написании запросов
  • Локальный помощник аналитика без передачи данных наружу
Размеры
350M – 7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Разбор текстаRUНе развивается2022–2023

Русские классификаторы токсичности и тональности

Давид Дале (cointegrated) и сообщество · Россия

Готовые крошечные модели на rubert-tiny для русского текста: находят грубость и оскорбления, определяют тональность и эмоции. Работают на процессоре за миллисекунды.

  • Фильтр оскорблений в чатах и комментариях на русском
  • Разметка отзывов на позитив, нейтрал и негатив
  • Поиск раздражённых клиентов в обращениях
Размеры
12M – 29M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
РеранкерыRUНе развивается2022

Cross-Encoder MS MARCO (MiniLM, TinyBERT, mMARCO)

UKP Lab и сообщество Sentence Transformers · Германия

Самые скачиваемые открытые реранкеры: крошечная модель читает пару «вопрос — найденный фрагмент» и ставит оценку близости. Многоязычная версия mMARCO знает русский.

  • Переупорядочивание результатов поиска по базе знаний
  • Отбор фрагментов перед ответом чат-бота
  • Поиск дублей среди обращений и карточек товаров
Размеры
около 4M – 120M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Обработка фотоGGUFНе развивается2021–2022

Real-ESRGAN

Tencent ARC Lab · Китай

Классика увеличения фото в 2–4 раза с очисткой от шума и артефактов сжатия. Лёгкая, работает даже на процессоре. Есть версии для рисунков и аниме.

  • Увеличение старых и мелких фото товаров
  • Очистка картинок от артефактов сжатия
  • Подготовка изображений к печати
Размеры
около 17M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Компьютерное зрениеНе развивается2021–2022

CLIP (OpenAI)

OpenAI · США

Модель 2021 года, которая первой связала картинки и текст: поиск фото по словам и классификация без обучения. Понимает только английский, сейчас чаще берут SigLIP 2 или PE.

  • Поиск картинок по текстовому запросу
  • Автоматические теги для каталога
  • Поиск похожих изображений
Размеры
около 0.15B – 0.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Компьютерное зрениеRUНе развивается2022

ruCLIP (ai-forever)

Сбер AI и SberDevices (ai-forever) · Россия

Русская версия CLIP: сопоставляет картинки и подписи на русском. Позволяет искать фото по описанию и раскладывать изображения по категориям без обучения.

  • Поиск товаров по фото и по русскому описанию
  • Сортировка картинок по категориям без разметки
  • Проверка соответствия фото и подписи
Размеры
150M – 430M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Обработка фотоGGUFНе развивается2021

LaMa

Samsung AI Center Москва (вместе со Сколтехом) · Россия

Удаление лишних объектов, надписей и водяных знаков с фото с аккуратной дорисовкой фона. Лёгкая и быстрая, до сих пор стандарт для такой задачи.

  • Удаление ценников, людей и мусора с фото
  • Чистка фото интерьеров и недвижимости
  • Удаление надписей и дат с архивных снимков
Размеры
около 51M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Обработка фотоНе развивается2021

SwinIR

ETH Zurich · Швейцария

Модель на трансформере для увеличения, шумоподавления и очистки фото от артефактов JPEG. Лёгкая и проверенная, часто стоит внутри других систем.

  • Увеличение фото
  • Шумоподавление снимков
  • Очистка от артефактов сжатия
Размеры
около 12M
Железо
от: Ноутбук
Можно в коммерциюПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение