КартинкиGGUF2025–2026
Alibaba · Китай
Генерация и редактирование картинок, в том числе с текстом на изображении. Ранние версии можно в коммерцию, свежая 2.1 — только некоммерческая.
- Инфографика для карточек товаров
- Правка фото по текстовой команде
- Рекламные креативы
- Размеры
- 7B – 20B
- Железо
- от: 1 видеокарта
ТекстRU2022–2026
Яндекс · Россия
Модели Яндекса, обученные с нуля с упором на русский язык и российские реалии. Новая AliceAI-Foundation 80B-A3B (Apache 2.0) — только базовая модель, инструкт-версии нет: её дообучают под свои задачи. Рядом экономичная AliceAI-T5 35B-A0.6B.
- Русскоязычный ассистент и чат-бот
- Ответы на вопросы по базе знаний компании
- Основа для дообучения под свою отрасль
- Размеры
- 8B – 100B
- Железо
- от: Ноутбук
Табличные данные2022–2026
Prior Labs (Университет Фрайбурга) · Германия
Готовая модель для таблиц: получает примеры строк и сразу предсказывает для новых, без долгого обучения и подбора настроек. Свободно для бизнеса только v2, новые версии некоммерческие.
- Прогноз оттока клиентов по выгрузке из CRM
- Скоринг заявок и лидов
- Классификация клиентов по данным из 1С
- Размеры
- от единиц до сотен миллионов параметров
- Железо
- от: Ноутбук
Табличные данные2025–2026
Amazon (команда AutoGluon) · США
Табличная модель Amazon, встроенная в AutoGluon: классификация и регрессия по примерам с коротким дообучением. Mitra-v2 держит больше строк и столбцов.
- Прогноз оттока и повторных покупок
- Скоринг заявок
- Прогноз суммы сделки или чека
- Размеры
- около 76M
- Железо
- от: Ноутбук
Табличные данные2025–2026
Stable AI (Пекин, с Университетом Цинхуа) · Китай
Модель для таблиц, которая одна умеет классифицировать, прогнозировать числа и заполнять пропуски в данных. Лёгкая LimiX-2M работает на обычном компьютере.
- Заполнение пропусков в выгрузках из 1С и CRM
- Прогноз оттока и скоринг
- Классификация клиентов и товаров
- Размеры
- 2M – 16M и LimiX-2
- Железо
- от: Ноутбук
Лица2021–2026
InsightFace (deepinsight) · Китай
Самый распространённый открытый набор для поиска и распознавания лиц. На нём стоят многие генераторы с сохранением лица. Готовые веса некоммерческие.
- Поиск и сравнение лиц на фото
- Пропуск по лицу в прототипах
- Обработка лиц как часть других ИИ-систем
- Размеры
- пакеты 16 МБ – 407 МБ
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Alibaba · Китай
Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.
- Чат-бот и ассистент по базе знаний
- Ответы на письма и обращения
- Разбор и классификация документов
- Размеры
- 0,6B – 2,4T-A95B
- Железо
- от: Ноутбук
Видео2025–2026
NVIDIA · США
Лёгкая и быстрая видеомодель NVIDIA. Выдаёт 720p-ролики на одной видеокарте, есть версия на 4 шага для быстрой генерации.
- Быстрые ролики для соцсетей
- Массовая генерация видео
- Видео из картинки
- Размеры
- 2B – 5B
- Железо
- от: 1 видеокарта
Прогнозы2024–2026
Google · США
Готовая модель прогнозов Google: строит прогноз по любому временному ряду без обучения на ваших данных.
- Прогноз продаж и спроса
- Планирование закупок и запасов
- Прогноз нагрузки и трафика
- Размеры
- 200M – 500M
- Железо
- от: Ноутбук
ТекстRUOllama2025–2026
Liquid AI · США
Модели новой архитектуры для работы прямо на устройстве: быстрые на обычном процессоре и в телефоне. Есть версии для извлечения данных, RAG и инструментов, а также LFM2.5-VL для картинок и голосовая LFM2.5-Audio.
- Ассистент на ноутбуке или телефоне без интернета
- Извлечение данных из документов
- Вызов инструментов в приложениях
- Размеры
- 230M – 24B-A2B
- Железо
- от: Ноутбук
Видео2025–2026
Alibaba · Китай
Генерация видео по тексту и по картинке. Младшая версия запускается на игровой видеокарте. После 2.2 базовые модели открыто не выходят, только прикладные: монтаж (VACE), говорящие персонажи по звуку (S2V), танцы под музыку (Dancer).
- Короткие рекламные ролики
- Оживление фото товара
- Видео для соцсетей
- Размеры
- 1,3B – 14B
- Железо
- от: 1 видеокарта
Видео2024–2026
Lightricks · Израиль
Быстрая видеомодель, которая с LTX-2 генерирует видео сразу со звуком и речью. Можно управлять камерой и позой, есть облегчённые версии.
- Рекламные ролики со звуком
- Видео из фото товара
- Озвученные сцены для соцсетей
- Размеры
- 2B – 22B
- Железо
- от: 1 видеокарта
ТекстGGUF2025–2026
Meituan · Китай
Модели Meituan (крупнейший сервис доставки Китая). LongCat-Flash динамически меняет объём вычислений под сложность запроса; LongCat-2.0 — 1,6 трлн параметров под MIT. Есть омни-модели (Flash-Omni, Next) и синтез речи AudioDiT.
- Агенты для заказов и сервисных процессов
- Корпоративный ассистент
- Разбор длинных документов
- Размеры
- 1B – 1.6T-A48B
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025–2026
Microsoft · США
Небольшие модели Microsoft для работы в браузере: смотрят на страницу и кликают, печатают, прокручивают. Рассчитаны на запуск прямо на рабочем компьютере без облака.
- Заполнение веб-форм и заявок
- Сбор данных из веб-кабинетов без API
- Проверка сайтов по сценарию
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
РеранкерыGGUF2024–2026
Jina AI · Германия
Сильные многоязычные реранкеры; m0 сортирует и страницы-картинки (сканы, слайды). Свежие версии открыты только для некоммерческого использования.
- Уточнение выдачи перед ответом чат-бота
- Сортировка найденных страниц PDF и слайдов
- Поиск по каталогу и базе знаний
- Размеры
- 33M – 2.4B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
Google · США
Компактные модели Google: хорошо работают на одном компьютере, старшие версии понимают картинки. Есть CodeGemma для кода, FunctionGemma 270M для вызова функций и быстрая DiffusionGemma.
- Ассистент на ноутбуке без интернета
- Разбор фото документов и чеков
- Классификация обращений
- Размеры
- 270M – 31B
- Железо
- от: Ноутбук
КартинкиGGUF2026
Krea · США
Модель картинок на 12B с упором на реализм без глянцевого «ИИ-вида». Turbo-версия выдаёт 2K-картинку за пару секунд.
- Реалистичные фото для рекламы
- Картинки высокого разрешения
- Дообучение стилей
- Размеры
- 12B
- Железо
- от: 1 видеокарта
Компьютерное зрение2025–2026
Roboflow · США
Детектор объектов в реальном времени, открытая замена YOLO без AGPL. Умеет сегментацию (контуры объектов), с 2026 года — ключевые точки.
- Детекция объектов на видео и фото
- Точные контуры деталей и дефектов
- Дообучение под свои классы объектов
- Размеры
- Nano – 2XL
- Железо
- от: Ноутбук
Прогнозы2025–2026
NXAI · Австрия
Компактная модель прогнозов на архитектуре xLSTM, лидер открытых тестов при малом размере. Быстро работает на обычном процессоре.
- Прогноз спроса и продаж
- Прогноз потребления энергии
- Прогнозы на слабом железе и на месте
- Размеры
- около 35M – 82M
- Железо
- от: Ноутбук
Картинка + текстOllama2024–2026
Moondream (M87 Labs) · США
Небольшая и быстрая модель зрения для продуктовых задач: ответы на вопросы, поиск и указание объектов, подписи. Moondream 3.1 — MoE на 9B с 2B активных.
- Поиск объектов и подсчёт на фото
- Проверка фото из полевых отчётов
- Подписи и теги для каталога
- Размеры
- 2B – 9B-A2B
- Железо
- от: Ноутбук
Документы и OCRRU2022–2026
Baidu (PaddlePaddle) · Китай
Классические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.
- Распознавание текста на сканах, фото и экранах
- Чтение этикеток, табло, маркировки на производстве и складе
- Разметка страниц: таблицы, формулы, печати, заголовки
- Размеры
- от 1.5M до десятков миллионов параметров
- Железо
- от: Ноутбук
КартинкиGGUF2025–2026
HiDream.ai · Китай
Открытые модели картинок под MIT: генерация (I1), редактирование по инструкции (E1) и единая модель O1-Image, которая делает и то и другое.
- Генерация картинок по описанию
- Правка изображений словами
- Вариации продуктовых фото
- Размеры
- около 9B – 17B
- Железо
- от: 1 видеокарта
3D2024–2026
VAST (TripoSR — вместе со Stability AI) · Китай
Семейство VAST: 3D-модель по одной фотографии. TripoSR работает меньше секунды, TripoSG даёт более чистую геометрию, TripoSplat строит сцену из гауссовых точек.
- 3D-модель товара по фото
- Заготовки объектов для игр и AR
- Быстрый 3D-прототип для печати
- Размеры
- до 1.5B
- Железо
- от: Ноутбук
Поиск и RAGRUGGUF2023–2026
Jina AI · Германия
Сильные многоязычные эмбеддинги с длинным контекстом, v5-omni понимает текст, картинки и аудио. Свежие версии открыты только для некоммерческого использования.
- Поиск по документам на многих языках
- Поиск по картинкам и сканам
- Классификация и кластеризация
- Размеры
- 33M – 3.8B
- Железо
- от: Ноутбук
ПереводRU2025–2026
Tencent · Китай
Переводчики Tencent на 33 языка, первая версия победила на соревновании WMT25. Русский есть. Малая версия 1.8B работает на ноутбуке, свежая Hy-MT2 под Apache 2.0.
- Перевод документов с сохранением форматирования
- Перевод с заданным глоссарием терминов
- Перевод переписки с китайскими партнёрами
- Размеры
- 1.8B – 30B-A3B
- Железо
- от: Ноутбук
Обработка фото2023–2026
BRIA AI · Израиль
Удаление фона от BRIA, обучено на лицензированных фото. Мягкие края, волосы, прозрачность. Есть версии для видео. Для бизнеса нужен платный договор.
- Вырезка товара на белый фон
- Фото сотрудников и экспертов без фона
- Удаление фона на видео
- Размеры
- 44M – 220M
- Железо
- от: Ноутбук
Картинка + текстOllama2023–2026
LLaVA / LMMs-Lab (исследователи из США и Китая) · США / Китай
Открытый проект, с которого пошла мода на модели «картинка + текст». Линейка OneVision понимает фото, документы и видео; открыты данные и рецепты обучения.
- Ответы на вопросы по фото и скриншотам
- Описание товаров по фотографии
- Разбор видео по кадрам
- Размеры
- 0.5B – 72B
- Железо
- от: Ноутбук
Картинка + текстOllama2024–2026
OpenBMB (ModelBest и Университет Цинхуа) · Китай
Компактные модели зрения, которые работают даже на телефоне и ноутбуке. Хорошо читают текст на фото, понимают видео; версия 4.6 весит всего 1.3B.
- Распознавание текста на фото прямо на устройстве
- Разбор чеков и документов без отправки в облако
- Описание фото и видео
- Размеры
- 1.3B – 8B
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025–2026
H Company · Франция
Французское семейство моделей для управления браузером и компьютером: точно находит нужный элемент на экране и ведёт многошаговые задачи. Свежие Holo3 и 3.1 открыты под Apache 2.0.
- Работа в веб-кабинетах и старых программах без API
- Заполнение форм и заявок
- Проверка интерфейсов по сценарию
- Размеры
- 0.8B – 235B-A22B
- Железо
- от: Ноутбук
Компьютерное зрение2024–2026
Meta · США
Модели Meta для анализа человека на фото: ключевые точки позы, разметка частей тела, нормали и глубина. Sapiens2 обучены на высоком разрешении и добавили маттинг людей.
- Определение позы и ключевых точек тела
- Разметка частей тела и одежды
- Отделение человека от фона
- Размеры
- 0.1B – 5B
- Железо
- от: Ноутбук
Прогнозы2024–2026
THUML, Университет Цинхуа · Китай
Компактная базовая модель прогнозов от лаборатории Цинхуа: обучена на большом наборе разнородных рядов и дообучается под свои данные.
- Прогноз спроса и нагрузки
- Прогноз показаний датчиков на производстве
- Дообучение прогноза под свою историю
- Размеры
- 84M (timer-base)
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Baidu · Китай
Первая открытая линия Baidu: от крошечной 0.3B до MoE на 424 млрд параметров, есть версии с пониманием картинок. Средняя 21B-A3B помещается на одну видеокарту; ERNIE-Image 8B рисует картинки с текстом.
- Корпоративный ассистент
- Разбор документов и изображений
- Классификация обращений
- Размеры
- 0.3B – 424B-A47B
- Железо
- от: Ноутбук
ПереводRU2020–2026
Helsinki-NLP, Хельсинкский университет · Финляндия
Более тысячи маленьких переводчиков, каждый под свою пару языков. Есть русский-английский и обратно. Работают быстро даже на обычном процессоре.
- Массовый перевод коротких текстов
- Перевод прямо на сервере без видеокарты
- Перевод отзывов и заявок перед анализом
- Размеры
- 25M – 240M
- Железо
- от: Ноутбук
Агенты для компьютера2024–2026
Show Lab (Национальный университет Сингапура) · Сингапур
Лёгкая модель для работы с интерфейсом: находит кнопки и поля по описанию и выполняет действия в вебе и на телефоне. ShowUI-π умеет перетаскивание мышью.
- Клики и заполнение форм по описанию задачи
- Автотесты веб-интерфейсов
- Помощник на слабом компьютере без облака
- Размеры
- 2B (ShowUI), около 500M (ShowUI-π)
- Железо
- от: Ноутбук
Разбор текстаOllama2024–2026
NuMind · Франция
Модели для извлечения данных по шаблону: даёте документ или скан и JSON-шаблон полей, получаете заполненный JSON. NuExtract3 (4B) заодно переводит сканы в Markdown.
- Извлечение реквизитов, сумм и дат из счетов и договоров в JSON
- Разбор чеков, накладных и анкет по заданному шаблону
- Перевод сканов в Markdown для поиска
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
Компьютерное зрение2023–2026
Meta · США
Выделяет любой объект на фото и видео по клику или рамке. Основа для удаления фона и подсчёта объектов.
- Удаление фона с фото товара
- Подсчёт объектов на фото
- Разметка данных для обучения
- Размеры
- 91M – ~0,85B
- Железо
- от: Ноутбук
Текст2025–2026
Reka AI · США
Компактные модели Reka: Flash 3 на 21B для рассуждений и Reka Edge на 7B, которая быстро разбирает изображения и видео на устройстве.
- Разбор фото и видео (Edge)
- Поиск объектов на изображениях
- Задачи с рассуждением (Flash)
- Размеры
- 7B – 21B
- Железо
- от: Ноутбук
Табличные данные2025–2026
Lexsi Labs · Индия
Свежие открытые модели для табличных данных: предсказывают по нескольким примерам прямо в запросе, без обучения под конкретную задачу.
- Классификация и прогноз по таблицам без отдельного обучения
- Быстрая проверка моделей на новых наборах данных
- Оценка признаков в больших таблицах
- Размеры
- размер не указан в карточке
- Железо
- от: Ноутбук
КартинкиGGUF2025–2026
Meituan · Китай
Модель генерации и редактирования картинок на 6B от Meituan. Хорошо пишет китайский текст, есть быстрая версия для правок.
- Генерация картинок по описанию
- Правка фото по инструкции
- Визуалы для карточек товаров
- Размеры
- 6B
- Железо
- от: 1 видеокарта
Голосовые ассистентыGGUF2025–2026
OpenBMB (ModelBest, Университет Цинхуа) · Китай
Небольшая модель, которая видит, слышит и отвечает голосом в реальном времени, может клонировать голос. Голосовой диалог на английском и китайском, текст — на 30+ языках.
- Голосовой ассистент на своём сервере
- Разбор видео и документов
- Ответы голосом по картинке с камеры
- Размеры
- 8B – 9B
- Железо
- от: Ноутбук
Примерка одежды2026
FASHN AI · Израиль
Редкая открытая примерка с коммерческой лицензией: без маски, берёт фото вещи на модели или раскладку. Веса около 2 ГБ.
- Карточки товара на модели без фотосессии
- Примерочная на сайте магазина
- Каталог из фото раскладки одежды
- Размеры
- 972M
- Железо
- от: 1 видеокарта
Агенты для компьютера2025–2026
Alibaba (Tongyi Lab, X-PLUG) · Китай
Модели для управления телефоном и компьютером из проекта Mobile-Agent: работают с Android, Windows, macOS и браузером, в версии 1.5 есть режим с рассуждением.
- Автоматизация действий в мобильных приложениях
- Работа в настольных программах без API
- Тестирование приложений по сценарию
- Размеры
- 2B – 32B
- Железо
- от: Ноутбук
Табличные данные2025–2026
Inria (команда Soda) · Франция
Открытая табличная модель от создателей scikit-learn: без обучения классифицирует и прогнозирует по примерам, тянет таблицы до сотен тысяч строк. Лицензия разрешает бизнес.
- Прогноз оттока клиентов
- Скоринг заявок и сделок
- Классификация клиентов по данным из 1С и CRM
- Размеры
- около 25–30M
- Железо
- от: Ноутбук
КартинкиGGUF2024–2026
Black Forest Labs · Германия
Генерация картинок от авторов Stable Diffusion. Хорошо рисует текст на изображении и держит композицию.
- Картинки для карточек товаров
- Баннеры и обложки
- Редактирование фото по описанию (Kontext)
- Размеры
- 4B – 32B
- Железо
- от: 1 видеокарта
КартинкиGGUF2025–2026
Alibaba (Tongyi-MAI) · Китай
Компактная модель на 6B с фотореализмом уровня крупных моделей. Turbo-версия выдаёт картинку за несколько шагов на обычной игровой видеокарте.
- Фотореалистичные рекламные картинки
- Картинки с текстом на английском и китайском
- Массовая генерация визуалов
- Размеры
- 6B
- Железо
- от: 1 видеокарта
АватарыGGUF2025–2026
Alibaba (Quark) · Китай
Потоковый аватар в реальном времени неограниченной длины. Подходит для живых эфиров и диалога, но требует мощного серверного железа.
- Живой аватар для диалога с клиентом
- Бесконечные трансляции с ведущим
- Интерактивные персонажи
- Размеры
- 14B
- Железо
- от: 1 видеокарта
Компьютерное зрение2023–2026
Ultralytics · США
Самый распространённый детектор объектов в реальном времени: находит и выделяет предметы на видео даже на слабом железе. YOLOv5 вышел ещё в 2020, в каталоге отсчёт от YOLOv8.
- Подсчёт людей, машин, товаров на видео
- Контроль касок и спецодежды
- Поиск брака на конвейере
- Размеры
- 2.4M – 68M
- Железо
- от: Ноутбук
ПереводRUOllama2026
Google · США
Переводчики на базе Gemma 3 на 55 языков, умеют переводить и текст на картинках. Русский есть. Версия 4B помещается на ноутбук.
- Перевод документов и переписки
- Перевод текста со скриншотов и фото
- Локализация сайтов и приложений
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
3DGGUF2024–2025
Microsoft · США
Одна из сильнейших открытых 3D-моделей: по картинке или тексту выдаёт сетку с текстурой или гауссову сцену. TRELLIS.2 заметно детальнее первой версии.
- 3D-модели товаров и интерьера по фото
- Ассеты для игр и AR/VR
- Прототипы для 3D-печати
- Размеры
- до 4B (TRELLIS.2)
- Железо
- от: 1 видеокарта
Агенты для компьютера2023–2025
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Одна из первых открытых моделей для управления интерфейсом по скриншоту, развитие — AutoGLM-Phone для работы в приложениях смартфона на Android.
- Автоматизация действий в мобильных приложениях
- Работа в веб-интерфейсах без API
- Тестирование приложений по сценарию
- Размеры
- 9B – 18B
- Железо
- от: 1 видеокарта
Компьютерное зрение2025
Meta · США
Семейство энкодеров Meta для картинок и видео, а с версией PE-AV — и для звука. PE-Core ищет по тексту точнее SigLIP 2 (по данным Meta), есть малые версии.
- Поиск фото и видео по описанию
- Разметка и теги каталога
- Поиск по звуку и видео (PE-AV)
- Размеры
- размер на карточке не указан
- Железо
- от: Ноутбук
Табличные данныеGGUF2024–2025
Чжэцзянский университет · Китай
Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.
- Ответы на вопросы по таблицам и выгрузкам
- Автоматический разбор данных с написанием кода
- Помощник в BI и внутренней отчётности
- Размеры
- 7B – 72B
- Железо
- от: 1 видеокарта
3DGGUF2025
Meta · США
Восстанавливает 3D-форму предмета или тела человека по одной обычной фотографии, даже если объект частично закрыт. Две модели: Objects и Body.
- 3D-модель предмета с фото из каталога
- Оценка позы и формы тела по фото
- Примерка и AR-сценарии
- Размеры
- н/д
- Железо
- от: 1 видеокарта
Компьютерное зрение2023–2025
Meta · США
Открытый повтор CLIP от Meta с прозрачным рецептом сбора данных. MetaCLIP 2 обучен на многоязычных данных со всего мира. Только некоммерческая лицензия.
- Поиск картинок по тексту
- Классификация изображений без обучения
- Исследования и прототипы поиска
- Размеры
- 0.15B – 3.6B
- Железо
- от: Ноутбук
ВидеоGGUF2025
Meituan · Китай
Видеомодель на 13.6B: из текста, из картинки и продолжение видео. Держит качество на роликах в несколько минут.
- Длинные ролики
- Видео из фото
- Продолжение готового видео
- Размеры
- 13.6B
- Железо
- от: 1 видеокарта
Компьютерное зрение2023–2025
IDEA Research · Китай
Находит на картинке любые объекты по текстовому описанию, без обучения на своих данных: «красная коробка», «человек без каски». Rex-Omni — новое поколение на базе VLM.
- Поиск объектов по описанию без разметки
- Автоматическая разметка данных для обучения
- Проверка фото на соответствие требованиям
- Размеры
- 172M – 3B
- Железо
- от: Ноутбук
ПрогнозыGGUF2024–2025
Amazon · США
Модели прогнозов Amazon, одни из самых скачиваемых. Chronos-2 учитывает внешние факторы: цены, акции, погоду.
- Прогноз спроса с учётом акций и цен
- Планирование запасов
- Прогноз выручки и потоков клиентов
- Размеры
- 8M – 710M
- Железо
- от: Ноутбук
Картинка + текстOllama2023–2025
Alibaba (команда Qwen) · Китай
Одна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.
- Извлечение данных из сканов счетов и накладных
- Разбор фотографий товаров и витрин
- Анализ видео и записей с камер
- Размеры
- 2B – 235B-A22B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024–2025
Mixedbread · Германия
Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.
- Поиск по базе знаний
- Переранжирование результатов перед ответом бота
- Поиск по каталогу товаров
- Размеры
- 17M – 1.5B
- Железо
- от: Ноутбук
ТекстRU2025
Авито Тех · Россия
Модель Авито на базе Qwen3-8B, переученная под русский язык: свой токенизатор, русские тексты быстрее на 15–25%. Умеет вызывать функции.
- Описания товаров и объявлений на русском
- Чат-бот с вызовом внутренних сервисов
- Разбор и классификация обращений
- Размеры
- 7.9B
- Железо
- от: Ноутбук
Картинка + текстRU2025
Авито Тех · Россия
Русскоязычная модель Авито, которая понимает картинки: описывает фото, отвечает на вопросы по изображению, читает надписи. Основа Qwen2.5-VL, на русском быстрее исходной.
- Описание товара по фото на русском
- Проверка, что фото совпадает с описанием
- Чтение брендов и надписей на картинках
- Размеры
- 7.4B
- Железо
- от: 1 видеокарта
3D2024–2025
Tencent · Китай
Открытая 3D-линейка Tencent: форма и текстура по картинке, качество на уровне платных сервисов. Omni добавляет управление позой и формой, Part делит модель на детали.
- 3D-модели товаров с текстурой
- Персонажи и предметы для игр
- Разделение модели на детали для печати
- Размеры
- набор моделей: форма и текстуры
- Железо
- от: 1 видеокарта
Голосовые ассистентыRUGGUF2025
Alibaba (Qwen) · Китай
Модели, которые понимают текст, картинки, аудио и видео и отвечают голосом в реальном времени. Qwen3-Omni говорит на 10 языках, включая русский.
- Голосовой ассистент для клиентов
- Разбор звонков и видео
- Ответы голосом по документам и картинкам
- Размеры
- 3B – 30B-A3B
- Железо
- от: Ноутбук
Текст в SQLGGUF2024–2025
Prem AI · Великобритания
Модель текст-в-SQL всего на 1B параметров: задумана для локального запуска, чтобы база данных не уходила во внешние сервисы.
- Локальный перевод вопросов в SQL без выхода в интернет
- Подсказки по запросам на слабом железе
- Встраивание в внутренние инструменты аналитики
- Размеры
- 1B
- Железо
- от: Ноутбук
ПрогнозыGGUF2024–2025
Salesforce · США
Универсальная модель прогнозов Salesforce для рядов с разной частотой и многими переменными. Веса открыты только для исследований.
- Исследовательские пилоты прогнозов
- Сравнение с другими моделями прогнозов
- Прогнозы по многим связанным рядам
- Размеры
- 11M – 311M
- Железо
- от: Ноутбук
Примерка одежды2025
Kunbyte AI · Китай
Примерка не только одежды: очки, серьги, сумки, шляпы, часы и другие аксессуары. Работает без маски. Требует видеокарту от 28 ГБ.
- Примерка аксессуаров и украшений на фото
- Карточки товара с аксессуаром на модели
- Примерочная очков и бижутерии на сайте
- Размеры
- дополнение к FLUX.1 Fill dev 12B
- Железо
- от: 1 видеокарта
Примерка одежды2025
LavieAI и Университет Сунь Ятсена · Китай
Примерка сразу нескольких вещей за раз: верх, низ, обувь, сумка. Быстрее прежних моделей за счёт кэширования. Лицензия некоммерческая.
- Сборка образа из нескольких товаров на одной модели
- Пилот «собери лук» на сайте
- Прототипы лукбуков без съёмки
- Размеры
- на базе SD 1.5 inpainting
- Железо
- от: 1 видеокарта
Обработка фотоGGUF2024–2025
Нанькайский университет · Китай
Открытая модель точного выделения объекта и удаления фона под лицензией MIT. На ней построен RMBG-2.0. Есть версии для 2K и для волос и полупрозрачных краёв.
- Удаление фона с фото товаров потоком
- Точные маски для дизайна и печати
- Вырезка людей с волосами для рекламы
- Размеры
- около 220M (есть облегчённые lite)
- Железо
- от: Ноутбук
КартинкиGGUF2024–2025
BAAI (Пекинская академия ИИ) · Китай
Универсальная модель: генерирует, редактирует, переносит объект или человека с фото в новую сцену без отдельных плагинов.
- Перенос товара или человека в новую сцену
- Редактирование фото по инструкции
- Генерация по нескольким референсам
- Размеры
- около 4B
- Железо
- от: 1 видеокарта
Обработка фото2025
ByteDance Seed · Китай
Восстановление и увеличение видео и фото от ByteDance. SeedVR2 делает это за один шаг, поэтому заметно быстрее похожих моделей. Коммерческая лицензия.
- Увеличение фото и видео до 2K–4K
- Восстановление старых роликов и снимков
- Улучшение пользовательских фото перед публикацией
- Размеры
- 3B – 7B
- Железо
- от: 1 видеокарта
Текст в SQLGGUF2025
IDEA Research · Китай
Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.
- Запросы к базе по вопросам с несколькими условиями
- Разбор и исправление чужих SQL-запросов
- Помощник аналитика в BI-системе
- Размеры
- 3B – 14B
- Железо
- от: Ноутбук
КартинкиGGUF2025
ByteDance Seed · Китай
Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.
- Редактирование фото в диалоге
- Ответы на вопросы по изображению
- Генерация картинок с пояснениями
- Размеры
- 14B-A7B
- Железо
- от: 1 видеокарта
Текст в SQL2025
Snowflake · США
Модель Snowflake для перевода вопросов в SQL, обученная с подкреплением на проверке результата запроса. Открыта версия 7B на базе Qwen2.5-Coder.
- Вопросы к хранилищу данных на обычном языке
- Генерация SQL для отчётов и дашбордов
- Проверка и исправление запросов аналитиков
- Размеры
- 7B
- Железо
- от: Ноутбук
Прогнозы2025
THUML, Университет Цинхуа · Китай
Модель прогнозов, которая выдаёт не одну линию, а набор возможных сценариев — удобно, когда нужен коридор спроса или нагрузки, а не одно число.
- Прогноз спроса с коридором значений
- Планирование запасов с учётом разброса
- Прогноз нагрузки на сервисы и персонал
- Размеры
- 128M (sundial-base)
- Железо
- от: Ноутбук
Примерка одежды2024–2025
Университет Сунь Ятсена и Pixocial · Китай
Лёгкая модель примерки, запускается на обычной видеокарте. Есть версия без маски и CatV2TON, который примеряет одежду и на видео.
- Примерка вещи на фото покупателя
- Черновые карточки товара на модели
- Примерка на коротком видео
- Размеры
- 899M
- Железо
- от: Ноутбук
Картинка + текстGGUF2024–2025
Hugging Face · Франция / США
Самые маленькие модели зрения Hugging Face: от 256M, работают в браузере и на телефоне. SmolVLM2 понимает и видео.
- Описание фото и видео на слабом железе
- Чтение простых документов
- Встраивание в мобильные и офлайн-приложения
- Размеры
- 256M – 2.2B
- Железо
- от: Ноутбук
Текст в SQL2025
Alibaba · Китай
Модели Alibaba для перевода вопросов в SQL на базе Qwen2.5-Coder. Работают с разными диалектами SQL, есть малая версия 3B для слабого железа.
- Вопросы к базе на обычном языке
- Запросы к разным СУБД (PostgreSQL, MySQL, SQLite)
- Автоматизация типовых отчётов
- Размеры
- 3B – 32B
- Железо
- от: Ноутбук
Модерация и безопасность2023–2025
Falconsai и Freepik · США и Испания
Небольшие модели, которые отличают откровенные картинки от обычных. Freepik различает четыре уровня откровенности. Работают на процессоре.
- Фильтр пользовательских фото и аватаров
- Проверка картинок от генераторов перед публикацией
- Разметка медиатеки
- Размеры
- 86M
- Железо
- от: Ноутбук
КартинкиGGUF2024–2025
NVIDIA · США
Быстрая модель картинок от NVIDIA: 4K-изображения за секунды и работа даже на ноутбучной видеокарте. Версия Sprint генерирует в 1–2 шага.
- Массовая генерация картинок
- Визуалы высокого разрешения
- Генерация в реальном времени в приложениях
- Размеры
- 0.6B – 4.8B
- Железо
- от: Ноутбук
Текст в SQL2025
Renmin University of China (RUC) · Китай
Модели для перевода вопросов в SQL, обученные на миллионах синтетических примеров запросов к разным базам. Три размера под разное железо.
- Вопросы к базе данных без знания SQL
- Генерация запросов для отчётов
- Основа для дообучения под свою схему базы
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Компьютерное зрение2023–2025
Google · США
Модели, которые переводят картинки и текст в общее пространство: можно искать фото по словам и классифицировать изображения без обучения. CLIP от OpenAI (2021) — предшественник.
- Поиск картинок по текстовому запросу
- Автоматическая разметка и теги каталога
- Фильтрация недопустимого контента
- Размеры
- около 0.2B – 2B
- Железо
- от: Ноутбук
Примерка одежды2025
Пекинский университет почты и связи и др. · Китай
Универсальный набор для одежды на базе FLUX: примерка, генерация модели в заданной вещи и «снятие» вещи с человека в отдельное фото товара.
- Примерка по фото товара
- Фото модели в вещи по текстовому описанию
- Чистое фото вещи со снимка человека
- Размеры
- дополнения (LoRA) к FLUX.1 dev 12B
- Железо
- от: 1 видеокарта
3D2024–2025
Stability AI · Великобритания
Модели Stability AI, которые за секунду превращают одну фотографию в 3D-модель с текстурой. SPAR3D позволяет поправить форму через облако точек.
- 3D-карточки товаров по фото
- Ассеты для игр и AR
- Быстрые макеты для дизайна
- Размеры
- 1B – 2B
- Железо
- от: 1 видеокарта
Обработка фото2024–2025
Prama LLC · США
Модель удаления фона с упором на сложные края: волосы, мех, тонкие детали. Открытая версия под MIT, умеет обрабатывать видео.
- Вырезка товара и людей с фото
- Удаление фона на видео
- Подготовка фото для каталога
- Размеры
- около 95M
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2019–2025
UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия
Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.
- Поиск по базе знаний и FAQ
- Поиск похожих обращений и дублей
- Группировка отзывов и заявок по темам
- Размеры
- около 20M – 470M
- Железо
- от: Ноутбук
Примерка одежды2024
Meta AI (вместе с King's College London) · США
Модель Meta для примерки и смены позы человека на фото. Бережно переносит мелкие детали ткани и надписи. Лицензия MIT, но обучающие данные некоммерческие.
- Примерка одежды на фото модели
- Смена позы модели на уже снятом кадре
- Добор ракурсов для карточки товара
- Размеры
- на базе Stable Diffusion
- Железо
- от: 1 видеокарта
Примерка одежды2024
Tencent и Фуданьский университет · Китай
Примерка на трансформере от Tencent: точнее передаёт фактуру ткани, мелкий принт и длину вещи. Лицензия некоммерческая.
- Примерка вещей со сложным принтом и фактурой
- Карточки товара на модели для тестов
- Подбор длины и посадки на фото
- Размеры
- на базе SD3
- Железо
- от: 1 видеокарта
Поиск по сканам документов2024
Alibaba (Tongyi Lab) · Китай
Один вектор и для текста, и для картинки, и для их пары: одной моделью можно искать товар по фото, страницу документа по вопросу и картинку по описанию. Языки в карточке: английский и китайский.
- Поиск товара по фотографии
- Поиск по каталогу картинок и карточек
- Поиск по страницам документов как по изображениям
- Размеры
- 2B и 7B
- Железо
- от: 1 видеокарта
КартинкиGGUF2022–2024
Stability AI · Великобритания
Модель, с которой началась открытая генерация картинок. Огромная экосистема дообучений, стилей и плагинов, работает даже на домашнем ПК. Популярные ускорители SDXL-Lightning и Hyper-SD сделала ByteDance.
- Иллюстрации и баннеры для рекламы
- Фоны и сцены для карточек товаров
- Дообучение под фирменный стиль
- Размеры
- 0.9B – 8B
- Железо
- от: Ноутбук
Поиск по сканам документов2024
TIGER-Lab · Канада
Превращает модель «картинка плюс текст» в модель эмбеддингов: один вектор для страницы, схемы или фото с подписью. В карточке заявлен английский язык.
- Поиск по смешанному архиву текстов и картинок
- Поиск по страницам документов как по изображениям
- Подбор похожих карточек и иллюстраций
- Размеры
- около 4B (на базе Phi-3.5-V)
- Железо
- от: 1 видеокарта
Прогнозы2024
Auton Lab, Университет Карнеги — Меллона · США
Базовая модель для рядов чисел: один движок используют и для прогноза, и для поиска аномалий, и для заполнения пропусков, и для классификации.
- Прогноз спроса и загрузки
- Поиск аномалий в показаниях датчиков и метриках
- Заполнение пропусков в исторических данных
- Размеры
- около 40M – 385M
- Железо
- от: Ноутбук
Прогнозы2024
IBM Research · США
Крошечные модели прогнозов от IBM: считаются на обычном процессоре, их ставят рядом с бизнес-системой без отдельного сервера с видеокартой.
- Прогноз продаж и остатков на складе
- Прогноз энергопотребления и нагрузки оборудования
- Быстрые прогнозы прямо на сервере компании
- Размеры
- очень маленькие: у TinyTimeMixers около 1M параметров
- Железо
- от: Ноутбук
Прогнозы2024
Команда Time-MoE · не раскрыта
Модель прогнозов с разреженной архитектурой: на каждом шаге работает лишь часть сети, поэтому она остаётся быстрой при небольшом размере.
- Прогноз продаж и остатков
- Прогноз нагрузки на сервисы и персонал
- Планирование закупок по истории
- Размеры
- 50M и 200M
- Железо
- от: Ноутбук
Табличные данныеНе развивается2024
ML Foundations · США
Базовая модель для предсказаний по таблицам: делает классификацию и прогноз по нескольким примерам, без отдельного обучения под задачу.
- Классификация записей в таблице по нескольким примерам
- Прогноз значения по строке данных
- Быстрая проверка гипотез на новых наборах данных
- Размеры
- 8B
- Железо
- от: 1 видеокарта
Картинка + текстНе развивается2024
Microsoft · США
Очень маленькая модель зрения: подписи, поиск объектов, сегментация и чтение текста по одной команде. Работает даже на процессоре.
- Чтение текста на фото
- Поиск и выделение объектов
- Автоматические подписи к фото
- Размеры
- 0.23B – 0.77B
- Железо
- от: Ноутбук
Обработка фотоНе развивается2023–2024
Shanghai AI Laboratory (OpenMMLab) и Университет Цинхуа · Китай
Универсальная дорисовка фото: убрать объект, вставить новый по описанию, заменить форму или расширить кадр за края.
- Удаление и замена объектов на фото
- Расширение кадра под нужный формат
- Вставка товара или детали по текстовому описанию
- Размеры
- на базе SD 1.5
- Железо
- от: Ноутбук
Обработка фотоНе развивается2024
Лвмин Чжан (автор ControlNet) · США
Меняет освещение на фото: ставит объект или человека в новый свет по описанию или под заданный фон, чтобы вырезка смотрелась естественно.
- Подгонка света товара под новый фон
- Студийный свет для портретов без пересъёмки
- Единый стиль освещения в каталоге
- Размеры
- на базе SD 1.5
- Железо
- от: Ноутбук
Текст в SQLOllamaНе развивается2023–2024
Defog · США
Одна из первых открытых моделей, которые переводят вопрос на обычном языке в SQL-запрос к базе. Есть в Ollama, но свежие конкуренты уже сильнее.
- Ответы на вопросы менеджеров по базе продаж без аналитика
- Черновики SQL-запросов для отчётов
- Помощник внутри BI-системы
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
3DНе развивается2024
Tencent ARC · Китай
Делает 3D-сетку по одной картинке примерно за 10 секунд: сначала рисует объект с нескольких ракурсов, потом собирает из них модель.
- 3D-модель объекта по фото
- Заготовки для игр и визуализаций
- Прототипы для 3D-печати
- Размеры
- н/д
- Железо
- от: 1 видеокарта
Примерка одеждыНе развивается2024
KAIST и OMNIOUS.AI · Южная Корея
Одна из самых известных открытых примерок: переносит вещь с фото товара на фото человека, хорошо держит принты и логотипы. Лицензия некоммерческая.
- Пилот примерочной на сайте магазина
- Прототип карточек товара на модели без фотосессии
- Сравнение с коммерческими сервисами примерки
- Размеры
- на базе SDXL
- Железо
- от: 1 видеокарта
Текст в SQLGGUFНе развивается2024
Chat2DB · Китай
Модель текст-в-SQL из открытого инструмента работы с базами Chat2DB: поддерживает разные диалекты SQL, карточка на английском и китайском.
- Перевод вопроса в SQL внутри клиента базы данных
- Черновики запросов под разные СУБД
- Подсказки разработчику при работе со схемой
- Размеры
- 7B
- Железо
- от: Ноутбук
Примерка одеждыНе развивается2024
Xiao-i Research · Китай
Ранняя популярная открытая примерка: одна версия для верхней одежды по пояс, другая для образа в полный рост. Лицензия некоммерческая.
- Примерка верха на фото модели
- Примерка в полный рост: верх, низ, платья
- Прототип примерочной для тестов
- Размеры
- на базе Stable Diffusion
- Железо
- от: 1 видеокарта
КартинкиНе развивается2023–2024
Playground AI · США
Модель на архитектуре SDXL с упором на эстетику: яркие цвета, контраст, портреты. Совместима с инструментами экосистемы SDXL.
- Эстетичные рекламные визуалы
- Портреты и лайфстайл-картинки
- Обложки для постов
- Размеры
- около 2.6B
- Железо
- от: 1 видеокарта
Поиск и RAGRUНе развивается2022–2024
Microsoft · США
Проверенные модели для смыслового поиска. Многоязычные версии хорошо работают с русским и до сих пор служат надёжной основой для RAG.
- Поиск по базе знаний и документам
- Подбор ответов для чат-бота (RAG)
- Поиск похожих обращений и дублей
- Размеры
- 33M – 7B
- Железо
- от: Ноутбук
Примерка одеждыНе развивается2024
KAIST · Южная Корея
Исследовательская модель примерки с конференции CVPR 2024, одна из первых на базе Stable Diffusion. Сейчас чаще служит точкой сравнения.
- Пилот примерки верхней одежды
- Сравнение качества разных моделей примерки
- Обучение своей примерки на базе открытого кода
- Размеры
- на базе Stable Diffusion
- Железо
- от: 1 видеокарта
Текст в SQLGGUFНе развивается2024
ChatDB · США
Модель текст-в-SQL на базе DeepSeek-Coder, рассчитанная на сложные вопросы с несколькими таблицами и условиями.
- Сложные запросы с соединением нескольких таблиц
- Ответы на вопросы по базе без аналитика
- Черновики SQL для отчётов и выгрузок
- Размеры
- 7B
- Железо
- от: Ноутбук
ВидеоНе развивается2023
Stability AI · Великобритания
Первая открытая модель Stability AI для видео: оживляет фото в ролик на 2–4 секунды. Сейчас уступает новым моделям по качеству.
- Оживление фото товара
- Короткие видеозаставки
- Анимация иллюстраций
- Размеры
- около 1.5B
- Железо
- от: 1 видеокарта
Текст в SQLНе развивается2023
RUCKBReasoning, Китайский народный университет · Китай
Ранняя линейка открытых моделей текст-в-SQL размером от 1B: есть варианты, дообученные под конкретные схемы баз данных.
- Перевод вопроса сотрудника в SQL-запрос
- Черновики запросов к хранилищу под отчёт
- Встраивание в BI-панель как подсказчик
- Размеры
- 1B – 15B
- Железо
- от: Ноутбук
Обработка фотоНе развивается2022–2023
Ким Тэхун (POSTECH) · Южная Корея
Модель выделения главного объекта и готовая программа transparent-background на её основе: убирает фон с фото, видео и веб-камеры одной командой.
- Пакетное удаление фона с фото
- Замена фона на цвет или размытие
- Удаление фона на видео
- Размеры
- небольшая (на базе Swin-B)
- Железо
- от: Ноутбук
Обработка фотоНе развивается2022–2023
XPixel Group (Шэньчжэньский институт передовых технологий АН Китая и др.) · Китай
Увеличение фото на трансформере, точнее SwinIR на тонких деталях. Есть версии для реальных снимков с шумом и лёгкая HAT-S.
- Увеличение фото товаров и интерьеров
- Подготовка изображений к печати
- Повышение чёткости архивных снимков
- Размеры
- 9M – 40M
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2023
Numbers Station · США
Одна из первых открытых линеек текст-в-SQL, включая совсем маленькие версии от 350M, которые запускаются на обычном ПК.
- Перевод вопроса в SQL по описанию таблиц
- Подсказки при написании запросов
- Локальный помощник аналитика без передачи данных наружу
- Размеры
- 350M – 7B
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2022–2023
Давид Дале (cointegrated) и сообщество · Россия
Готовые крошечные модели на rubert-tiny для русского текста: находят грубость и оскорбления, определяют тональность и эмоции. Работают на процессоре за миллисекунды.
- Фильтр оскорблений в чатах и комментариях на русском
- Разметка отзывов на позитив, нейтрал и негатив
- Поиск раздражённых клиентов в обращениях
- Размеры
- 12M – 29M
- Железо
- от: Ноутбук
РеранкерыRUНе развивается2022
UKP Lab и сообщество Sentence Transformers · Германия
Самые скачиваемые открытые реранкеры: крошечная модель читает пару «вопрос — найденный фрагмент» и ставит оценку близости. Многоязычная версия mMARCO знает русский.
- Переупорядочивание результатов поиска по базе знаний
- Отбор фрагментов перед ответом чат-бота
- Поиск дублей среди обращений и карточек товаров
- Размеры
- около 4M – 120M
- Железо
- от: Ноутбук
Обработка фотоGGUFНе развивается2021–2022
Tencent ARC Lab · Китай
Классика увеличения фото в 2–4 раза с очисткой от шума и артефактов сжатия. Лёгкая, работает даже на процессоре. Есть версии для рисунков и аниме.
- Увеличение старых и мелких фото товаров
- Очистка картинок от артефактов сжатия
- Подготовка изображений к печати
- Размеры
- около 17M
- Железо
- от: Ноутбук
Компьютерное зрениеНе развивается2021–2022
OpenAI · США
Модель 2021 года, которая первой связала картинки и текст: поиск фото по словам и классификация без обучения. Понимает только английский, сейчас чаще берут SigLIP 2 или PE.
- Поиск картинок по текстовому запросу
- Автоматические теги для каталога
- Поиск похожих изображений
- Размеры
- около 0.15B – 0.6B
- Железо
- от: Ноутбук
Компьютерное зрениеRUНе развивается2022
Сбер AI и SberDevices (ai-forever) · Россия
Русская версия CLIP: сопоставляет картинки и подписи на русском. Позволяет искать фото по описанию и раскладывать изображения по категориям без обучения.
- Поиск товаров по фото и по русскому описанию
- Сортировка картинок по категориям без разметки
- Проверка соответствия фото и подписи
- Размеры
- 150M – 430M
- Железо
- от: Ноутбук
Обработка фотоGGUFНе развивается2021
Samsung AI Center Москва (вместе со Сколтехом) · Россия
Удаление лишних объектов, надписей и водяных знаков с фото с аккуратной дорисовкой фона. Лёгкая и быстрая, до сих пор стандарт для такой задачи.
- Удаление ценников, людей и мусора с фото
- Чистка фото интерьеров и недвижимости
- Удаление надписей и дат с архивных снимков
- Размеры
- около 51M
- Железо
- от: Ноутбук
Обработка фотоНе развивается2021
ETH Zurich · Швейцария
Модель на трансформере для увеличения, шумоподавления и очистки фото от артефактов JPEG. Лёгкая и проверенная, часто стоит внутри других систем.
- Увеличение фото
- Шумоподавление снимков
- Очистка от артефактов сжатия
- Размеры
- около 12M
- Железо
- от: Ноутбук