МедицинаGGUF2023–2026
FreedomIntelligence (Китайский университет Гонконга, Шэньчжэнь) · Китай
Большое семейство медицинских моделей: чат, версия со снимками, рассуждающая HuatuoGPT-o1 и новая HuatuoGPT-3 на Qwen3. Не заменяет врача, решения принимает специалист.
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Подсказки при разборе снимков для врача (Vision)
- Размеры
- 7B – 72B
- Железо
- от: Ноутбук
Речь в текстRUGGUF2025–2026
Microsoft · США
Речевые модели Microsoft: синтез длинных диалогов на несколько голосов, быстрый синтез для живого общения и распознавание длинных записей с разделением по говорящим, в том числе на русском.
- Расшифровка длинных встреч с разметкой говорящих
- Озвучка подкастов и диалогов
- Голос для ассистентов в реальном времени
- Размеры
- 0.5B – 9B
- Железо
- от: Ноутбук
Музыка и звук2026
HeartMuLa Team · не указана
Открытая модель генерации песен с вокалом на китайском, английском, японском, корейском и испанском, плюс кодек и модель расшифровки текста песен.
- Песни и джинглы по тексту
- Музыка для роликов
- Расшифровка текста песен
- Размеры
- 3B
- Железо
- от: 1 видеокарта
ТекстOllama2023–2026
DeepSeek · Китай
Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.
- Ассистент для сотрудников на своём сервере
- Разбор длинных договоров и отчётов
- Агенты, которые работают с инструментами и API
- Размеры
- 7B – 1.6T-A49B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Shanghai AI Laboratory · Китай
Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.
- Помощник исследователя: статьи, формулы, данные
- Разбор научных и технических документов
- Корпоративный чат на малых моделях
- Размеры
- 1.8B – около 1T
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Xiaomi · Китай
Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.
- Логические и расчётные задачи
- Агенты с инструментами
- Помощь программистам
- Размеры
- 7B – 1,02T-A42B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Сбер · Россия
Открытые модели Сбера, обученные с упором на русский язык: хорошо пишут и понимают по-русски, знают местные реалии. Есть лёгкая 10B-A1.8B и флагманы до 702B, всё под MIT. GigaChat3.1-Audio понимает звук и записи до двух часов, GFusion — быстрая диффузионная версия для текста.
- Русскоязычный ассистент для сотрудников на своём сервере
- Ответы клиентам и разбор обращений на русском
- Работа с договорами и внутренними регламентами
- Размеры
- 10B-A1.8B – 702B-A36B
- Железо
- от: Ноутбук
Табличные данные2025–2026
Amazon (команда AutoGluon) · США
Табличная модель Amazon, встроенная в AutoGluon: классификация и регрессия по примерам с коротким дообучением. Mitra-v2 держит больше строк и столбцов.
- Прогноз оттока и повторных покупок
- Скоринг заявок
- Прогноз суммы сделки или чека
- Размеры
- около 76M
- Железо
- от: Ноутбук
Табличные данные2025–2026
Layer 6 AI (TD Bank) · Канада
Табличная модель от ИИ-лаборатории канадского банка, обученная на реальных таблицах, а не только на синтетике. Версия 1.2 Turbo на порядки ускорила расчёт.
- Скоринг заявок и клиентов
- Прогноз оттока
- Классификация операций и клиентов
- Размеры
- около 60–80M
- Железо
- от: Ноутбук
Текст2024–2026
OpenBMB (ModelBest и Университет Цинхуа) · Китай
Компактные текстовые модели для работы прямо на устройстве: ноутбуке, телефоне, мини-ПК. MiniCPM5 на 1B и 2B ориентированы на вызов инструментов и длинный контекст.
- Локальный чат-ассистент без облака
- Извлечение данных и классификация текстов
- Вызов инструментов и простые агенты на слабом железе
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
Текст2024–2026
MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ
Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.
- Рассуждения, математика и технические вопросы
- Разбор длинных документов
- Агенты и написание кода
- Размеры
- 0.9B – 375B-A23B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Жэньминьский университет (GSAI) и Ant Group (inclusionAI) · Китай
Диффузионные языковые модели: текст пишется не по одному слову, а сразу блоками с последующим уточнением, что ускоряет генерацию. LLaDA2.2 умеет править уже написанное и рассчитана на агентов. Генератор картинок LLaDA-Image — отдельный продукт.
- Быстрая генерация кода и текстов
- Агентные сценарии с длинным контекстом
- Исследования альтернатив обычным LLM
- Размеры
- 8B – 100B (MoE)
- Железо
- от: 1 видеокарта
Автономное вождение2020–2026
comma.ai · США
Открытая система помощи водителю: нейросеть по камере держит полосу и управляет скоростью, плюс модель контроля внимания водителя. Модели лежат прямо в репозитории и обновляются постоянно.
- Исследовательский стенд систем помощи водителю
- Изучение контроля внимания водителя по камере в салоне
- Сравнение со своими алгоритмами удержания полосы
- Размеры
- компактная, рассчитана на бортовое устройство
- Железо
- от: Ноутбук
Поиск по сканам документовGGUF2026
Tencent · Китай
Модели Tencent на базе Qwen3.5 для поиска по сканам и PDF как по картинкам. По данным карточки, на момент выхода — среди лучших в рейтинге ViDoRe.
- Поиск по сканам и PDF без распознавания
- RAG по отчётам с таблицами и графиками
- Поиск по архивам документов
- Размеры
- 4.5B – 8B
- Железо
- от: 1 видеокарта
ТекстRU2026
SberDevices (ai-forever) · Россия
Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.
- Эксперименты с ускорением генерации
- Дообучение небольших моделей под свои задачи
- Исследования
- Размеры
- 0.6B – 4B
- Железо
- от: Ноутбук
Детекция подделок2023–2026
Adobe Research и University of Surrey · США
Водяной знак для картинок любого разрешения, сделанный для инициативы Content Authenticity: умеет и ставить метку, и снимать её. Детектор ошибается в обе стороны — вывод проверяет человек.
- Пометка изображений на выходе из своего пайплайна
- Проверка происхождения присланной картинки
- Связка с метаданными о происхождении контента
- Размеры
- варианты моделей Q и P, разная ёмкость метки
- Железо
- от: Ноутбук
ВидеоGGUF2025–2026
Sand AI · Китай
Видео, которое генерируется по кускам друг за другом, поэтому ролик можно продлевать бесконечно. MAGI-2 делает видео сразу со звуком.
- Длинные ролики с продолжением
- Видео со звуком
- Оживление изображений
- Размеры
- 4.5B – 114B-A6B
- Железо
- от: 1 видеокарта
Видео2025–2026
NVIDIA · США
Лёгкая и быстрая видеомодель NVIDIA. Выдаёт 720p-ролики на одной видеокарте, есть версия на 4 шага для быстрой генерации.
- Быстрые ролики для соцсетей
- Массовая генерация видео
- Видео из картинки
- Размеры
- 2B – 5B
- Железо
- от: 1 видеокарта
Компьютерное зрение2024–2026
Microsoft Research · США
Восстанавливает 3D-геометрию сцены по одной фотографии: глубину в метрах, облако точек и нормали поверхностей.
- Замеры помещений и объектов по фото
- 3D-облако точек из снимка
- Подготовка данных для роботов и AR
- Размеры
- ViT-S – ViT-G
- Железо
- от: Ноутбук
Поиск и RAGRU2024–2026
Сбер (SberDevices) · Россия
Эмбеддинги Сбера, заточенные под русский язык: по данным разработчиков, в числе лучших на русскоязычных тестах поиска. FRIDA компактная, Giga-Embeddings мощнее.
- Поиск по русскоязычным документам
- RAG для чат-ботов на русском
- Классификация обращений и отзывов
- Размеры
- 480M – 10B-A1.8B
- Железо
- от: Ноутбук
Роботы2025–2026
GigaAI · Китай
Модель управления роботами, обученная в основном на синтетических данных из модели мира. Позволяет меньше тратить на сбор данных с реальных роботов.
- Управление манипулятором
- Дообучение на малом объёме своих данных
- Пилоты сортировки и сборки
- Размеры
- 3.5B
- Железо
- от: 1 видеокарта
Речь в текстGGUF2024–2026
Moonshine AI (Useful Sensors) · США
Очень маленькие и быстрые модели распознавания речи для телефонов, планшетов и встраиваемых устройств. Вторая версия работает потоково и выдаёт текст, пока человек ещё говорит.
- Голосовое управление устройствами
- Распознавание на телефоне без интернета
- Живые субтитры
- Размеры
- 27M – 245M
- Железо
- от: Ноутбук
Речь в текстGGUF2025–2026
IBM · США
Речевые модели IBM для распознавания и перевода речи на английском и нескольких европейских языках и японском. Рассчитаны на корпоративное использование.
- Расшифровка деловых встреч
- Перевод речи в текст на другом языке
- Голосовые ассистенты
- Размеры
- 470M – 8B
- Железо
- от: Ноутбук
Текст2025–2026
Ant Group (inclusionAI) · Китай
Семейство Ant Group: Ling — обычные модели, Ring — рассуждающие. Есть и триллионные флагманы, и экономичная Ling-3.0-tiny, которой хватает 1,3 млрд активных параметров.
- Корпоративный ассистент
- Агенты для офисных процессов
- Финансовая аналитика (есть версия Fin)
- Размеры
- 7.9B-A1.3B – 1T
- Железо
- от: Ноутбук
ТекстOllama2024–2026
IBM · США
Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.
- Ответы по внутренним документам (RAG)
- Вызов инструментов и работа в агентах
- Извлечение данных и классификация
- Размеры
- 350M – 34B
- Железо
- от: Ноутбук
ТекстOllama2026
Meta Superintelligence Labs · США
Открытая модель Meta для агентов на доступном железе: дистиллирована из закрытой Muse Spark, понимает текст и картинки, обучена на 100+ языках.
- Агенты с вызовом инструментов
- Разбор скриншотов, графиков и документов
- Многоязычный ассистент
- Размеры
- 30B
- Железо
- от: 1 видеокарта
Разбор текста2024–2026
Урчаде Заратиана и Fastino AI · Франция / США
Находит в тексте нужные сущности без обучения: просто перечисляете, что искать (имя, сумма, дата). GLiNER2 заодно классифицирует текст. Многоязычные версии понимают русский.
- Извлечение имён, сумм и дат из писем и договоров
- Разбор заявок на поля CRM
- Классификация обращений по темам
- Размеры
- около 50M – 500M
- Железо
- от: Ноутбук
Документы и OCR2026
TeleAI (China Telecom) · Китай
Новая лёгкая модель для разбора документов, на момент выхода лидер теста OmniDocBench v1.6. Хорошо справляется со снятыми на телефон и помятыми страницами. Языки в карточке — китайский, английский, японский.
- Распознавание счетов и накладных, снятых на телефон
- Распознавание таблиц и формул
- Перевод документов в Markdown для RAG
- Размеры
- около 1.2B
- Железо
- от: Ноутбук
Агенты для компьютера2025–2026
XLANG Lab (Гонконгский университет) · Китай
Полностью открытые агенты для рабочего стола: веса, данные и код обучения. Работают в Windows, macOS и Linux, свежий Qwen-CUA управляет компьютером обычными кликами и клавишами.
- Работа в настольных программах без API
- Перенос данных между системами
- Прогон пользовательских сценариев для тестов
- Размеры
- 7B – около 400B (MoE)
- Железо
- от: 1 видеокарта
КодOllama2026
DeepReinforce · не раскрыта
Модели для агентной разработки: сами строят план и обвязку под задачу и выполняют её в терминале. Дообучены на базе Qwen 3.5 и Gemma 4, работают с Claude Code, OpenHands и похожими инструментами.
- Агент-разработчик в терминале
- Исправление ошибок по описанию задачи
- Разбор и доработка большого репозитория
- Размеры
- 9B – 397B
- Железо
- от: 1 видеокарта
Погода и климат2024–2026
Allen Institute for AI (Ai2) · США
Быстрый эмулятор климатической модели: моделирует атмосферу на годы и десятилетия вперёд на одной видеокарте. Есть связка с океаном (SamudrACE) для долгосрочных сценариев.
- Сценарии климата на десятилетия для оценки долгосрочных рисков активов
- Массовые расчёты «что если» по температуре и осадкам
- Подготовка данных для моделей урожайности и спроса на энергию
- Размеры
- чекпоинт около 1,8 ГБ
- Железо
- от: 1 видеокарта
Погода и климат2023–2026
Google DeepMind · Великобритания
Семейство глобальных погодных моделей Google DeepMind: GraphCast (прогноз на 10 дней), GenCast (ансамбль вероятностей) и WeatherNext 2 с прогнозом циклонов. С августа 2026 веса разрешены для коммерции.
- Среднесрочный прогноз погоды для планирования смен, рейсов и поставок
- Вероятностная оценка экстремальной погоды для страховых портфелей
- Прогноз траекторий тропических циклонов для морских и портовых операций
- Размеры
- от облегчённых версий 1° до полных 0,25°
- Железо
- от: 1 видеокарта
Биология и химия2022–2026
Лаборатория AlQuraishi (Колумбийский университет) и консорциум OpenFold · США
Полностью открытое воспроизведение AlphaFold 2, а затем AlphaFold 3 под Apache 2.0 с обучающими данными. OpenFold3 предсказывает комплексы белков, нуклеиновых кислот и лигандов.
- Предсказание структуры белков и комплексов с лигандами
- Дообучение на собственных данных компании (код обучения открыт)
- Внутренний сервис структурного анализа без передачи данных наружу
- Размеры
- один набор весов на версию
- Железо
- от: 1 видеокарта
Автономное вождение2026
Alibaba (команда Qwen) · Китай
Модель для автономного вождения на базе Qwen3.5-4B: 3D-распознавание объектов вокруг машины, ответы на вопросы о дорожной сцене и планирование траектории в одной модели.
- Прототип восприятия и планирования для беспилотной техники на закрытой территории
- Ответы на вопросы о записях с камер при разборе инцидентов
- Разметка дорожных сцен для обучения своих моделей
- Размеры
- 4B
- Железо
- от: 1 видеокарта
Детекция подделок2025–2026
University of Michigan · США
Лёгкий детектор сгенерированных картинок, обученный на 2,7 млн примеров почти от 5000 разных генераторов. Ошибается в обе стороны: результат — повод для проверки человеком, а не доказательство.
- Проверка присланных фото и иллюстраций
- Фильтрация ИИ-картинок в потоке контента
- Разметка подозрительных изображений для ручной проверки
- Размеры
- 22M
- Железо
- от: Ноутбук
Детекция подделок2023–2026
University of Wisconsin-Madison · США
Ранний и до сих пор используемый подход: поверх замороженного CLIP обучается простой классификатор, который переносится на незнакомые генераторы. Ошибается в обе стороны — вывод требует проверки человеком.
- Проверка изображений от новых, незнакомых генераторов
- Базовая линия при сравнении детекторов
- Быстрое внедрение проверки без дообучения крупной модели
- Размеры
- линейный классификатор поверх CLIP ViT-L/14
- Железо
- от: Ноутбук
Видео2025–2026
Alibaba · Китай
Генерация видео по тексту и по картинке. Младшая версия запускается на игровой видеокарте. После 2.2 базовые модели открыто не выходят, только прикладные: монтаж (VACE), говорящие персонажи по звуку (S2V), танцы под музыку (Dancer).
- Короткие рекламные ролики
- Оживление фото товара
- Видео для соцсетей
- Размеры
- 1,3B – 14B
- Железо
- от: 1 видеокарта
Код2025–2026
Kwaipilot (Kuaishou) · Китай
Модели Kuaishou для агентной разработки, обученные решать реальные задачи в репозиториях. KAT-Coder-V2.5-Dev (35B, активны 3B) — открытая версия их закрытого флагмана.
- Агент, исправляющий задачи в репозитории
- Генерация и рефакторинг кода
- Автоматизация рутинных задач разработки
- Размеры
- 32B – 72B, 35B-A3B
- Железо
- от: 1 видеокарта
КартинкиRU2022–2026
Сбер (Kandinsky Lab) · Россия
Российское семейство генерации картинок и видео от Сбера. Хорошо понимает запросы на русском и российский культурный контекст, открыто под MIT.
- Картинки по описанию на русском
- Короткие рекламные ролики из текста или фото
- Редактирование изображений по инструкции
- Размеры
- 2B – 19B
- Железо
- от: 1 видеокарта
Роботы2025–2026
NVIDIA · США
Модели «мира» для роботов и беспилотников: генерируют реалистичное видео физических сцен и предсказывают действия. Cosmos 3 объединяет понимание, генерацию и управление.
- Синтетические видео для обучения роботов и беспилотников
- Проверка сценариев в симуляции
- Управление роботом (Policy-версии)
- Размеры
- 2B – 65B
- Железо
- от: 1 видеокарта
Роботы2026
Ant Group (Robbyant) · Китай
Модель управления роботами от Ant Group, обученная на большом объёме данных с реальных роботов. Версия 2.0 работает с разными типами манипуляторов.
- Управление двуруким манипулятором
- Дообучение под свою операцию
- Пилоты сборки и сортировки
- Размеры
- 4B – 6B
- Железо
- от: 1 видеокарта
Роботы2026
Xiaomi · Китай
Открытые модели управления роботами от Xiaomi. Robotics-1 рассчитана на бытовые и кухонные задачи, U0 объединяет понимание сцены и действия.
- Управление манипулятором по команде
- Бытовые и сервисные сценарии
- Основа для дообучения
- Размеры
- 4B – 5B
- Железо
- от: 1 видеокарта
Речь в текстRUGGUF2024–2026
Сбер · Россия
Модели Сбера для распознавания русской речи, одни из самых точных для русского языка. Есть распознавание эмоций, версия v3 с пунктуацией и многоязычная версия (русский, казахский, киргизский, узбекский).
- Расшифровка звонков на русском
- Протоколы совещаний
- Голосовое управление сервисами
- Размеры
- 220M – 600M
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Meituan · Китай
Модели Meituan (крупнейший сервис доставки Китая). LongCat-Flash динамически меняет объём вычислений под сложность запроса; LongCat-2.0 — 1,6 трлн параметров под MIT. Есть омни-модели (Flash-Omni, Next) и синтез речи AudioDiT.
- Агенты для заказов и сервисных процессов
- Корпоративный ассистент
- Разбор длинных документов
- Размеры
- 1B – 1.6T-A48B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Т-Банк · Россия
Модели Т-Банка, дообученные на основе Qwen специально для русского языка: заметно лучше исходной модели пишут и рассуждают по-русски. T-Lite — 8B, T-Pro — 32B на одну видеокарту; T-Search — агент для многошагового поиска на русском и английском.
- Русскоязычный чат-бот поддержки
- Разбор обращений и документов на русском
- Ответы по базе знаний компании
- Размеры
- 7B – 36B-A3B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Swiss AI (ETH Zurich, EPFL, CSCS) · Швейцария
Государственная открытая модель Швейцарии: открыты веса, данные и рецепт, более 1000 языков в обучении. Версия 1.5 понимает изображения.
- Многоязычный ассистент
- Ответы по документам
- Разбор изображений и сканов (v1.5)
- Размеры
- 0.5B – 70B
- Железо
- от: Ноутбук
ТекстGGUF2026
Thinking Machines Lab · США
Флагманские открытые модели лаборатории Миры Мурати: принимают текст, изображения и аудио. Большие MoE, требуют нескольких видеокарт.
- Корпоративный ассистент уровня флагмана
- Разбор документов, изображений и аудио
- Помощь в программировании
- Размеры
- 276B-A12B, 975B-A41B
- Железо
- от: Кластер
КодGGUF2026
Poolside · США
Модели для агентного программирования: самостоятельно правят код в репозитории. Младшая XS запускается на Mac с 36 ГБ памяти, у S 2.1 контекст 1M токенов.
- Агент-программист для внутренней разработки
- Исправление ошибок и доработка кода
- Работа с большими кодовыми базами
- Размеры
- 33B-A3B – 225B-A23B
- Железо
- от: 1 видеокарта
Картинка + текстGGUF2024–2026
Alibaba (AIDC-AI) · Китай
Модели зрения от международного подразделения Alibaba с сильным чтением текста и таблиц. В линейке есть MoE Ovis2.6 и отдельные компактные OvisOCR для документов.
- Извлечение данных из счетов, договоров и накладных
- Распознавание таблиц
- Ответы на вопросы по фото и графикам
- Размеры
- 0.9B – 80B-A3B
- Железо
- от: Ноутбук
Голос: спикеры и звукGGUF2022–2026
Сообщество WeNet · Китай
Набор готовых моделей «голосового отпечатка»: сравнивает, один ли человек говорит в двух записях, и помогает делить запись по спикерам. Одна из моделей встроена в pyannote 3.x.
- Голосовая проверка клиента при звонке
- Поиск повторных звонков одного человека
- Разметка записи по спикерам
- Размеры
- от единиц до десятков миллионов параметров
- Железо
- от: Ноутбук
Голос: спикеры и звук2022–2026
Meta AI, затем Александр Дефоссе · Франция
Классическая модель, которая разделяет трек на голос, барабаны, бас и остальное. Версия v4 с гибридным трансформером остаётся эталоном; сейчас проект поддерживает автор в своём репозитории.
- Отделить голос от музыки в записи
- Минусовки и дорожки для караоке
- Очистка речи в видео с фоновой музыкой
- Размеры
- десятки миллионов параметров
- Железо
- от: Ноутбук
Голос: спикеры и звук2023–2026
Сообщество RVC-Project · Китай
Самый массовый открытый инструмент конверсии голоса: модель под конкретный голос учится за 10–30 минут записи, работает в реальном времени. Использовать только с согласия владельца голоса.
- Озвучка контента одним фирменным голосом
- Перепевка и работа с вокалом
- Смена голоса в реальном времени
- Размеры
- десятки миллионов параметров
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025–2026
Microsoft · США
Небольшие модели Microsoft для работы в браузере: смотрят на страницу и кликают, печатают, прокручивают. Рассчитаны на запуск прямо на рабочем компьютере без облака.
- Заполнение веб-форм и заявок
- Сбор данных из веб-кабинетов без API
- Проверка сайтов по сценарию
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
Картинка + текст2026
OpenMOSS (Фуданьский университет) · Китай
Модель «картинка + видео + текст» с упором на длинные видео и точную привязку событий к секундам. Есть версия Realtime для потокового видео в реальном времени.
- Разбор длинных видео и поиск событий по времени
- Потоковый анализ видео в реальном времени
- Понимание фото и документов
- Размеры
- около 11B
- Железо
- от: 1 видеокарта
Погода и климат2024–2026
Microsoft Research · США
Базовая модель атмосферы Земли: глобальный прогноз погоды, отдельные версии для качества воздуха и морских волн. Считает прогноз за секунды вместо часов на суперкомпьютере.
- Собственный прогноз температуры, ветра и осадков по точкам присутствия компании
- Оценка волнения моря для планирования рейсов и портовых работ
- Прогноз загрязнения воздуха для промышленных площадок
- Размеры
- около 1,3B (есть малая версия для тестов)
- Железо
- от: 1 видеокарта
Реранкеры2026
Tencent · Китай
Пара небольших моделей Tencent на базе Qwen3 для подбора ИИ-агенту нужного навыка (skill) под запрос: эмбеддинг находит кандидатов, реранкер выбирает лучший.
- Выбор инструмента или навыка для ИИ-агента
- Маршрутизация запросов между сценариями бота
- Поиск по каталогу внутренних инструментов
- Размеры
- 0.6B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
Google · США
Компактные модели Google: хорошо работают на одном компьютере, старшие версии понимают картинки. Есть CodeGemma для кода, FunctionGemma 270M для вызова функций и быстрая DiffusionGemma.
- Ассистент на ноутбуке без интернета
- Разбор фото документов и чеков
- Классификация обращений
- Размеры
- 270M – 31B
- Железо
- от: Ноутбук
КодGGUF2025–2026
JetBrains · Чехия
Модели JetBrains для быстрого автодополнения кода. Mellum2 (12B, активны 2.5B) уже полноценный помощник: пишет и правит код, вызывает инструменты, рассуждает.
- Быстрое автодополнение кода на своём сервере
- Помощник разработчика без отправки кода в облако
- Дообучение на коде компании
- Размеры
- 4B – 12B-A2.5B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025–2026
Open Thoughts (Стэнфорд, Беркли и другие университеты) · США
Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики регламентов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Компьютерное зрение2025–2026
Roboflow · США
Детектор объектов в реальном времени, открытая замена YOLO без AGPL. Умеет сегментацию (контуры объектов), с 2026 года — ключевые точки.
- Детекция объектов на видео и фото
- Точные контуры деталей и дефектов
- Дообучение под свои классы объектов
- Размеры
- Nano – 2XL
- Железо
- от: Ноутбук
Прогнозы2025–2026
NXAI · Австрия
Компактная модель прогнозов на архитектуре xLSTM, лидер открытых тестов при малом размере. Быстро работает на обычном процессоре.
- Прогноз спроса и продаж
- Прогноз потребления энергии
- Прогнозы на слабом железе и на месте
- Размеры
- около 35M – 82M
- Железо
- от: Ноутбук
Речь в текстRUGGUF2026
Alibaba (Qwen) · Китай
Модели распознавания речи от команды Qwen на 50+ языков, включая русский. Хорошо справляются с шумом, пением и акцентами.
- Расшифровка звонков и встреч
- Субтитры к видео
- Распознавание на нескольких языках
- Размеры
- 0.6B – 1.7B
- Железо
- от: Ноутбук
Речь в текстGGUF2026
Cohere · Канада
Модель распознавания речи от Cohere на 14 языков (русского в списке нет), отдельная версия для арабского. Рассчитана на точную расшифровку деловых записей.
- Расшифровка встреч и интервью
- Субтитры
- Поиск по аудиоархиву
- Размеры
- 2B
- Железо
- от: Ноутбук
Синтез речиRUGGUF2025–2026
Zyphra · США
Синтез речи с клонированием голоса и тонкой настройкой эмоций, скорости и высоты голоса.
- Клонирование голоса
- Эмоциональная озвучка
- Озвучка роликов
- Размеры
- около 1.6B
- Железо
- от: Ноутбук
Музыка и звукRUGGUF2025–2026
ACE Studio и StepFun · Китай
Быстрая генерация песен с вокалом на 19 языках, включая русский: полная песня за секунды, правка отдельных фрагментов и смена стиля.
- Песни и джинглы для рекламы
- Фоновая музыка для роликов
- Демо-версии композиций
- Размеры
- около 2B – 4B
- Железо
- от: Ноутбук
Модерация и безопасность2024–2026
Сообщество GLiNER (Fastino, Knowledgator, NVIDIA и др.) · США
Маленькие модели на основе GLiNER для поиска персональных данных: паспортов, телефонов, счетов, адресов. Типы данных задаются словами. Русский официально не заявлен.
- Маскирование персональных данных перед облачным ИИ
- Поиск паспортных данных и реквизитов в документах
- Проверка выгрузок на утечки
- Размеры
- около 200M – 500M
- Железо
- от: Ноутбук
Документы и OCR2026
Baidu · Китай
OCR-модель Baidu, развивающая идеи DeepSeek-OCR: разбирает многостраничные документы и PDF целиком за один проход и выдаёт размеченный текст. Заявлена как многоязычная, но список языков не опубликован.
- Перевод многостраничных PDF и сканов в текст и Markdown
- Распознавание договоров, счетов и отчётов
- Подготовка архивов документов к поиску и RAG
- Размеры
- 3.3B
- Железо
- от: Ноутбук
Документы и OCRRU2022–2026
Baidu (PaddlePaddle) · Китай
Классические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.
- Распознавание текста на сканах, фото и экранах
- Чтение этикеток, табло, маркировки на производстве и складе
- Разметка страниц: таблицы, формулы, печати, заголовки
- Размеры
- от 1.5M до десятков миллионов параметров
- Железо
- от: Ноутбук
Картинка + текст2023–2026
Shanghai AI Lab (OpenGVLab) · Китай
Семейство моделей для видео: энкодеры для поиска и классификации роликов и чат-модели, которые разбирают длинные видео. InternVideo 3 рассчитан на многочасовые записи.
- Поиск по видеоархиву текстовым запросом
- Распознавание действий на видео
- Ответы на вопросы по длинной записи
- Размеры
- малые энкодеры – 9B
- Железо
- от: Ноутбук
ВидеоGGUF2025–2026
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Анимирует персонажа с картинки по движениям из другого видео, в том числе сложные развороты и несколько персонажей. SCAIL-2 работает без промежуточного скелета и умеет заменять персонажа в ролике.
- Перенос движений актёра на персонажа
- Замена персонажа в готовом видео
- Анимация маскотов и иллюстраций
- Размеры
- 14B
- Железо
- от: 1 видеокарта
КартинкиGGUF2025–2026
HiDream.ai · Китай
Открытые модели картинок под MIT: генерация (I1), редактирование по инструкции (E1) и единая модель O1-Image, которая делает и то и другое.
- Генерация картинок по описанию
- Правка изображений словами
- Вариации продуктовых фото
- Размеры
- около 9B – 17B
- Железо
- от: 1 видеокарта
АватарыGGUF2025–2026
Meituan · Китай
Говорящие люди по аудио на базе LongCat-Video. Версия 1.5 доведена до продакшна: стабильные длинные ролики на китайском и английском.
- Видео с ведущим новостей или курса
- Промо-ролики с говорящим персонажем
- Пение и озвучка
- Размеры
- на базе LongCat-Video 13.6B
- Железо
- от: 1 видеокарта
3D2024–2026
VAST (TripoSR — вместе со Stability AI) · Китай
Семейство VAST: 3D-модель по одной фотографии. TripoSR работает меньше секунды, TripoSG даёт более чистую геометрию, TripoSplat строит сцену из гауссовых точек.
- 3D-модель товара по фото
- Заготовки объектов для игр и AR
- Быстрый 3D-прототип для печати
- Размеры
- до 1.5B
- Железо
- от: Ноутбук
Роботы2025–2026
Ai2 (Allen Institute for AI) · США
Полностью открытая модель управления роботом, которая сначала «рассуждает» о пространстве и траектории, а потом действует. Ход рассуждений можно проверить.
- Управление манипулятором с объяснимыми шагами
- Дообучение под свой робот
- Исследовательские пилоты
- Размеры
- 5B – 8B
- Железо
- от: 1 видеокарта
Синтез речиRUGGUF2025–2026
Resemble AI · США
Синтез речи с клонированием голоса и настройкой эмоциональности. Многоязычная версия поддерживает 23 языка, включая русский; Turbo и Flash ускорены для живого диалога.
- Голос для бота и ассистента
- Клонирование фирменного голоса
- Озвучка роликов
- Размеры
- около 350M – 500M
- Железо
- от: Ноутбук
Синтез речиRU2025–2026
OpenMOSS (Фуданьский университет) · Китай
Семейство синтеза речи: озвучка диалогов на несколько голосов (TTSD), быстрый синтез для живого общения и крошечная Nano. Версия 1.5 поддерживает 30+ языков, включая русский.
- Озвучка подкастов и диалогов
- Голос для ассистента
- Клонирование голоса
- Размеры
- 100M – 8.5B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
StepFun · Китай
MoE-модели StepFun, рассчитанные на быструю и дешёвую работу: при 196 млрд параметров Step-3.5/3.7-Flash задействуют около 11 млрд на токен. Есть компактные Step3-VL-10B для картинок и голосовая Step-Audio 2 mini.
- Агенты с высокой нагрузкой
- Разбор документов со схемами и скриншотами
- Помощь программистам
- Размеры
- 8B – 321B
- Железо
- от: 1 видеокарта
Картинка + текстOllama2023–2026
LLaVA / LMMs-Lab (исследователи из США и Китая) · США / Китай
Открытый проект, с которого пошла мода на модели «картинка + текст». Линейка OneVision понимает фото, документы и видео; открыты данные и рецепты обучения.
- Ответы на вопросы по фото и скриншотам
- Описание товаров по фотографии
- Разбор видео по кадрам
- Размеры
- 0.5B – 72B
- Железо
- от: Ноутбук
Картинка + текстOllama2024–2026
OpenBMB (ModelBest и Университет Цинхуа) · Китай
Компактные модели зрения, которые работают даже на телефоне и ноутбуке. Хорошо читают текст на фото, понимают видео; версия 4.6 весит всего 1.3B.
- Распознавание текста на фото прямо на устройстве
- Разбор чеков и документов без отправки в облако
- Описание фото и видео
- Размеры
- 1.3B – 8B
- Железо
- от: Ноутбук
Картинка + текстGGUF2025–2026
Kuaishou · Китай
Модели зрения от Kuaishou с упором на короткие видео. Keye-VL-2.0 (30B, активны 3B) хорошо понимает, что и когда происходит в ролике.
- Разбор и описание коротких видео
- Проверка роликов и контента
- Поиск нужного момента в видео
- Размеры
- 8B – 671B-A37B
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2025–2026
Baidu (PaddlePaddle) · Китай
Компактная модель для разбора документов из популярного набора PaddleOCR. По карточке поддерживает 109 языков, в том числе русский; версия 1.6 лидирует на тесте OmniDocBench.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Распознавание таблиц, формул, печатей
- Перевод сканов в Markdown и JSON
- Размеры
- 0.9B
- Железо
- от: Ноутбук
Документы и OCRGGUF2025–2026
Shanghai AI Laboratory (OpenDataLab) · Китай
Популярный открытый инструмент перевода PDF в Markdown со своей небольшой моделью. MinerU2.5-Pro улучшили только за счёт данных, без роста размера. Языки в карточке — китайский и английский.
- Перевод PDF-отчётов и договоров в Markdown
- Распознавание таблиц и формул
- Подготовка документов для RAG и поиска
- Размеры
- 0.9B – 1.2B
- Железо
- от: Ноутбук
Биология и химия2022–2026
EvolutionaryScale / Chan Zuckerberg Biohub (ESM-2 — Meta AI) · США
Языковые модели белков: понимают аминокислотные последовательности, предсказывают структуру (ESMFold2) и помогают в дизайне белков. С 2026 года все открытые версии под MIT.
- Эмбеддинги белков для предсказания свойств (стабильность, растворимость)
- Предсказание 3D-структуры белков и комплексов
- Отбор кандидатов в дизайне ферментов и антител перед лабораторией
- Размеры
- 8M – 15B (ESM-2), 300M – 6B (ESM C), 1,4B (открытая ESM3)
- Железо
- от: Ноутбук
Прогнозы2024–2026
THUML, Университет Цинхуа · Китай
Компактная базовая модель прогнозов от лаборатории Цинхуа: обучена на большом наборе разнородных рядов и дообучается под свои данные.
- Прогноз спроса и нагрузки
- Прогноз показаний датчиков на производстве
- Дообучение прогноза под свою историю
- Размеры
- 84M (timer-base)
- Железо
- от: Ноутбук
Аватары2024–2026
Фуданьский университет · Китай
Серия говорящих портретов по аудио: от коротких клипов до часовых видео в 4K. Hallo-Live рассчитана на работу в реальном времени.
- Видео с ведущим по фото и аудио
- Длинные обучающие ролики
- Живой аватар
- Размеры
- около 1B – 5B
- Железо
- от: 1 видеокарта
Поиск и RAGRUOllama2024–2026
IBM · США
Лёгкие эмбеддинги IBM для корпоративного поиска, обученные на данных с понятными правами. R2 2026 года стали многоязычными.
- Поиск по корпоративным документам
- RAG на обычном сервере без видеокарты
- Переранжирование результатов
- Размеры
- 30M – 311M
- Железо
- от: Ноутбук
ПрогнозыGGUF2025–2026
Datadog · США
Модель прогнозов от Datadog, обученная на метриках серверов и приложений. Особенно сильна для IT-мониторинга: нагрузка, задержки, ошибки.
- Прогноз нагрузки на серверы
- Поиск аномалий в метриках
- Планирование мощностей
- Размеры
- 4M – 2.5B
- Железо
- от: Ноутбук
Синтез речиRUGGUF2025–2026
OpenBMB (ModelBest, Университет Цинхуа) · Китай
Синтез речи с клонированием голоса и естественной интонацией. VoxCPM2 поддерживает 30 языков, включая русский.
- Клонирование голоса
- Озвучка роликов и аудиокниг
- Голос для ассистента
- Размеры
- 0.5B – 2.3B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Baidu · Китай
Первая открытая линия Baidu: от крошечной 0.3B до MoE на 424 млрд параметров, есть версии с пониманием картинок. Средняя 21B-A3B помещается на одну видеокарту; ERNIE-Image 8B рисует картинки с текстом.
- Корпоративный ассистент
- Разбор документов и изображений
- Классификация обращений
- Размеры
- 0.3B – 424B-A47B
- Железо
- от: Ноутбук
ТекстRUGGUF2025–2026
Arcee AI · США
Американское семейство MoE-моделей, обученных с нуля: Nano, Mini и Large. Trinity-Large-Thinking на 398B рассуждает перед ответом.
- Агенты с вызовом инструментов
- Задачи с рассуждением
- Корпоративный ассистент на своих серверах
- Размеры
- 6B – 398B-A13B
- Железо
- от: Ноутбук
ПереводRU2020–2026
Helsinki-NLP, Хельсинкский университет · Финляндия
Более тысячи маленьких переводчиков, каждый под свою пару языков. Есть русский-английский и обратно. Работают быстро даже на обычном процессоре.
- Массовый перевод коротких текстов
- Перевод прямо на сервере без видеокарты
- Перевод отзывов и заявок перед анализом
- Размеры
- 25M – 240M
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2024–2026
IBM · США
Модели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.
- Проверка запросов и ответов бота
- Поиск выдуманных фактов в ответах по базе знаний
- Проверка своих правил, заданных текстом
- Размеры
- 38M – 8B
- Железо
- от: Ноутбук
Модерация и безопасность2026
OpenAI · США
Находит и скрывает персональные данные: имена, адреса, телефоны, почту, номера счетов, пароли. Работает даже в браузере. Обучена в основном на английском.
- Очистка текста от персональных данных перед отправкой в облачный ИИ
- Поиск паролей и ключей в текстах
- Обезличивание переписки для аналитики
- Размеры
- 1.5B (50M активных)
- Железо
- от: Ноутбук
Картинка + текстOllama2025–2026
IBM · США
Компактные модели IBM для корпоративных документов: таблицы, графики, формы, пары «поле — значение». Карточка честно предупреждает, что лучше всего работает с английским.
- Извлечение полей из форм и счетов
- Перевод графиков и таблиц в данные
- Ответы на вопросы по документам
- Размеры
- 2B – 4B
- Железо
- от: Ноутбук
Разбор текстаOllama2024–2026
NuMind · Франция
Модели для извлечения данных по шаблону: даёте документ или скан и JSON-шаблон полей, получаете заполненный JSON. NuExtract3 (4B) заодно переводит сканы в Markdown.
- Извлечение реквизитов, сумм и дат из счетов и договоров в JSON
- Разбор чеков, накладных и анкет по заданному шаблону
- Перевод сканов в Markdown для поиска
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
Синтез речи2025–2026
Kyutai · Франция
Потоковые модели распознавания и синтеза речи от авторов Moshi: начинают говорить и расшифровывать, не дожидаясь конца фразы. Pocket TTS (100M) работает на процессоре. Английский, французский и ещё несколько европейских языков, русского нет.
- Потоковая расшифровка речи для голосовых ботов
- Озвучка ответов с минимальной задержкой
- Синтез речи на сервере без видеокарты (Pocket TTS)
- Размеры
- 100M (Pocket TTS) – 2.6B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
ServiceNow · США
Модели ServiceNow на 15B с пошаговыми рассуждениями, которые помещаются на одну видеокарту. С версии 1.5 понимают и картинки, хорошо вызывают инструменты.
- Ассистент с рассуждениями для внутренних сервисов
- Вызов инструментов и корпоративные агенты
- Разбор скриншотов и документов с картинками
- Размеры
- 5B – 15B
- Железо
- от: Ноутбук
КодOllama2025–2026
Essential AI · США
Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.
- Генерация и исправление кода
- Агент-разработчик на одной видеокарте
- Решение технических и научных задач
- Размеры
- 8B
- Железо
- от: Ноутбук
Поиск и RAGGGUF2025–2026
Octen · США / Сингапур
Дообученные Qwen3-Embedding от стартапа Octen под поиск в юридических, финансовых и медицинских текстах. Версия 8B на январь 2026 возглавляла рейтинг RTEB.
- Поиск по договорам и судебной практике
- Поиск по финансовым отчётам
- Поиск по длинным документам до 32 тыс. токенов
- Размеры
- 0.6B – 8B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовRU2025–2026
SberDevices (ai-forever) · Россия
Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.
- Автоматическая проверка качества ответов чат-бота на русском
- Сравнение нескольких моделей перед выбором
- Контроль ответов после дообучения
- Размеры
- 4B – 32B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Иван Бондаренко (bond005), НГУ · Россия
Русскоязычные модели для работы с документами, а не для болтовни: ответы по базе знаний, извлечение сущностей и фактов из текста на русском, длинный контекст.
- Ответы на вопросы по внутренним документам
- Извлечение имён, дат и сумм из договоров
- Краткое изложение длинных текстов на русском
- Размеры
- 1.5B – 7.6B
- Железо
- от: Ноутбук
МедицинаGGUF2025–2026
Чжэцзянский университет · Китай
Медицинская модель для текста, снимков, 3D-исследований и видео: от лёгкой 4B до крупной MoE. Не заменяет врача, решения принимает специалист.
- Подсказки при разборе снимков и КТ для врача
- Черновики заключений и выписок
- Поиск по медицинской литературе
- Размеры
- 4B – 235B-A22B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025–2026
Принстонский университет · США
Открытые модели для формальных доказательств в Lean 4 из Принстона. Свежая Goedel-Code-Prover доказывает корректность программ.
- Формальная проверка математических выкладок
- Проверка корректности кода
- Обучение
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Поиск и RAGGGUF2026
Perplexity · США
Эмбеддинги поискового сервиса Perplexity. Есть версии, которые учитывают контекст всего документа, а не только отдельного фрагмента.
- Поиск по большим массивам документов
- RAG с учётом контекста документа
- Поиск по сайту и каталогу
- Размеры
- 0.6B – 4B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
Sarvam AI · Индия
Индийские модели с упором на 22 языка Индии. Sarvam 30B и 105B 2026 года это MoE-модели с сильными навыками рассуждения и работы в агентах.
- Многоязычная поддержка клиентов
- Задачи с рассуждением и расчётами
- Агенты с вызовом инструментов
- Размеры
- 2B – 105B-A10B
- Железо
- от: Ноутбук
Картинка + текстGGUF2023–2026
Shanghai AI Laboratory (OpenGVLab) · Китай
Большая линейка китайских моделей зрения с размерами от 1B до 241B. InternVL-U (4B) объединяет понимание картинок, их генерацию и редактирование.
- Понимание документов, схем и графиков
- Ответы на вопросы по фото
- Разбор видео
- Размеры
- 1B – 241B-A28B
- Железо
- от: Ноутбук
Картинка + текст2024–2026
Ai2 (Allen Institute for AI) · США
Полностью открытые модели зрения Ai2 (веса и данные). Умеют указывать точку на картинке и считать предметы; Molmo2 понимает видео, MolmoWeb управляет браузером.
- Подсчёт товаров и объектов на фото
- Указание, где на снимке нужный предмет
- Разбор видео
- Размеры
- 1B-A7B – 72B
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2025–2026
rednote hilab (Xiaohongshu) · Китай
Многоязычная модель для разбора документов: текст, таблицы, формулы и порядок чтения за один проход. dots.mocr ещё переводит графики и схемы в векторный SVG.
- Распознавание счетов, договоров и накладных
- Перевод таблиц в редактируемый вид
- Перевод графиков и схем в векторный формат
- Размеры
- около 3B
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2026
Baidu (Qianfan) · Китай
Модель Baidu, которая не только распознаёт документ, но и отвечает на вопросы по нему. По карточке поддерживает 192 языка, включая кириллицу.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Разметка страницы и распознавание таблиц
- Ответы на вопросы по документу
- Размеры
- 4B
- Железо
- от: Ноутбук
Голос: спикеры и звукRU2026
FireRedTeam (Xiaohongshu) · Китай
Детектор речи и звуковых событий: отличает речь, пение и музыку. В тесте на 102 языках (набор FLEURS, русский входит) обошёл Silero VAD и TEN VAD. Есть потоковый режим.
- Нарезка записей перед распознаванием речи
- Отделение речи от музыки и пения в эфирах и роликах
- Определение речи в голосовых ботах
- Размеры
- компактная, точный размер не указан
- Железо
- от: Ноутбук
Видео2025–2026
Skywork AI (Kunlun) · Китай
Интерактивная «модель мира»: генерирует видео игрового мира в реальном времени и реагирует на нажатия клавиш и мышь. Версия 3.0 держит память о сцене минутами.
- Прототипы игровых миров без движка
- Интерактивные демо и симуляции
- Генерация данных для обучения агентов
- Размеры
- 1.8B – 17B
- Железо
- от: 1 видеокарта
Музыка и звук2025–2026
Alibaba Tongyi (FunAudioLLM) · Китай
Генерирует и редактирует звук к видео, тексту или аудио, сначала «рассуждая» о сцене через мультимодальную модель. PrismAudio — следующая версия для звука к видео.
- Звук к видео по сцене
- Редактирование отдельных звуков в дорожке
- Звуковые эффекты по описанию
- Размеры
- размер на карточке не указан
- Железо
- от: 1 видеокарта
Аватары2026
SII-GAIR и Sand.ai · Китай
Генерирует видео с говорящим человеком сразу со звуком: один трансформер обрабатывает текст, видео и аудио. Речь на 7 языках, русского в списке нет. Есть дистиллированные быстрые версии.
- Видео с ведущим по сценарию
- Рекламные ролики с говорящим персонажем
- Обучающие видео с диктором
- Размеры
- 15B
- Железо
- от: 1 видеокарта
Поиск и RAGRU2026
Microsoft · США
Многоязычные эмбеддинги Microsoft 2026 года с контекстом до 32 тыс. токенов, русский в списке языков. Версии 270M и 0.6B идут на обычном сервере, 27B — самая точная.
- Поиск по базе знаний на разных языках
- Подбор фрагментов для RAG
- Поиск по длинным документам
- Размеры
- 270M – 27B
- Железо
- от: Ноутбук
Табличные данные2025–2026
Lexsi Labs · Индия
Свежие открытые модели для табличных данных: предсказывают по нескольким примерам прямо в запросе, без обучения под конкретную задачу.
- Классификация и прогноз по таблицам без отдельного обучения
- Быстрая проверка моделей на новых наборах данных
- Оценка признаков в больших таблицах
- Размеры
- размер не указан в карточке
- Железо
- от: Ноутбук
КодOllama2024–2026
Alibaba (команда Qwen) · Китай
Самая широкая открытая линейка для кода: от 0.5B для автодополнения до 480B для агентов. Qwen3-Coder-Next (80B, активны 3B) работает как агент-разработчик на одной видеокарте.
- Автодополнение кода в редакторе
- Агент, который сам правит код в репозитории
- Генерация и доработка скриптов, SQL, интеграций
- Размеры
- 0.5B – 480B-A35B
- Железо
- от: Ноутбук
Код2026
Ai2 (Allen Institute for AI) · США
Полностью открытые агенты-разработчики от Ai2: открыты веса, данные и рецепт обучения. Задуманы так, чтобы компания могла дешево доучить агента на своём репозитории.
- Агент для исправления задач в коде
- Дообучение агента под внутренний репозиторий
- Автоматизация мелких правок и тестов
- Размеры
- 8B – 32B
- Железо
- от: Ноутбук
КартинкиGGUF2025–2026
Meituan · Китай
Модель генерации и редактирования картинок на 6B от Meituan. Хорошо пишет китайский текст, есть быстрая версия для правок.
- Генерация картинок по описанию
- Правка фото по инструкции
- Визуалы для карточек товаров
- Размеры
- 6B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2026
LM Provers (CMU, Hugging Face, ETH Zurich, Project Numina) · США, Швейцария, Франция
Маленькая модель 4B на Qwen3, которая пишет математические доказательства на обычном языке почти на уровне больших моделей. Запускается на ноутбуке.
- Проверка логики рассуждений и выкладок
- Пошаговое объяснение решений
- Обучение и олимпиадная подготовка
- Размеры
- 4B
- Железо
- от: Ноутбук
Голосовые ассистентыGGUF2025–2026
OpenBMB (ModelBest, Университет Цинхуа) · Китай
Небольшая модель, которая видит, слышит и отвечает голосом в реальном времени, может клонировать голос. Голосовой диалог на английском и китайском, текст — на 30+ языках.
- Голосовой ассистент на своём сервере
- Разбор видео и документов
- Ответы голосом по картинке с камеры
- Размеры
- 8B – 9B
- Железо
- от: Ноутбук
Примерка одежды2026
FASHN AI · Израиль
Редкая открытая примерка с коммерческой лицензией: без маски, берёт фото вещи на модели или раскладку. Веса около 2 ГБ.
- Карточки товара на модели без фотосессии
- Примерочная на сайте магазина
- Каталог из фото раскладки одежды
- Размеры
- 972M
- Железо
- от: 1 видеокарта
Агенты для компьютера2025–2026
Alibaba (Tongyi Lab, X-PLUG) · Китай
Модели для управления телефоном и компьютером из проекта Mobile-Agent: работают с Android, Windows, macOS и браузером, в версии 1.5 есть режим с рассуждением.
- Автоматизация действий в мобильных приложениях
- Работа в настольных программах без API
- Тестирование приложений по сценарию
- Размеры
- 2B – 32B
- Железо
- от: Ноутбук
Табличные данные2025–2026
Inria (команда Soda) · Франция
Открытая табличная модель от создателей scikit-learn: без обучения классифицирует и прогнозирует по примерам, тянет таблицы до сотен тысяч строк. Лицензия разрешает бизнес.
- Прогноз оттока клиентов
- Скоринг заявок и сделок
- Классификация клиентов по данным из 1С и CRM
- Размеры
- около 25–30M
- Железо
- от: Ноутбук
Биология и химия2024–2026
Arc Institute (с Together AI, Stanford, NVIDIA) · США
Языковые модели ДНК с контекстом до миллиона нуклеотидов: оценивают влияние мутаций, аннотируют геномы и генерируют последовательности. Evo 2 обучена на геномах всех царств жизни.
- Оценка вероятной вредности генетических вариантов для исследований
- Аннотация геномов микроорганизмов и растений
- Поиск перспективных последовательностей в селекции и синтетической биологии
- Размеры
- 1B – 40B
- Железо
- от: 1 видеокарта
Картинка + текст2026
Sukhrob Nurali · не раскрыта
Дообученная Qwen3-VL-8B читает страницы резюме как картинки и возвращает запись из 23 полей в JSON. Автор прямо пишет: для автоматических решений по кандидатам модель не предназначена, решение принимает человек.
- Перенос резюме из PDF в карточку кандидата
- Заполнение базы кандидатов без ручного ввода
- Разбор резюме с разной вёрсткой и оформлением
- Размеры
- 8B, дообучение Qwen3-VL-8B-Instruct
- Железо
- от: 1 видеокарта
КартинкиGGUF2025–2026
Alibaba (Tongyi-MAI) · Китай
Компактная модель на 6B с фотореализмом уровня крупных моделей. Turbo-версия выдаёт картинку за несколько шагов на обычной игровой видеокарте.
- Фотореалистичные рекламные картинки
- Картинки с текстом на английском и китайском
- Массовая генерация визуалов
- Размеры
- 6B
- Железо
- от: 1 видеокарта
Картинки2026
Zhipu AI (Z.ai) · Китай
Гибрид языковой модели на 9B и декодера на 7B. Сильна в картинках с большим количеством текста: постеры, инфографика, слайды.
- Постеры и баннеры с текстом
- Инфографика
- Иллюстрации к презентациям
- Размеры
- 9B + 7B
- Железо
- от: 1 видеокарта
Аватары2024–2026
Ant Group · Китай
Говорящие аватары от Ant Group: лицо, а с V2 и жесты рук. V3-Flash выдаёт видео за 8 шагов и укладывается в 12 ГБ видеопамяти.
- Видео с ведущим по фото и голосу
- Аватар с жестами для презентаций
- Озвученные персонажи
- Размеры
- до 1.3B
- Железо
- от: 1 видеокарта
АватарыGGUF2025–2026
Alibaba (Quark) · Китай
Потоковый аватар в реальном времени неограниченной длины. Подходит для живых эфиров и диалога, но требует мощного серверного железа.
- Живой аватар для диалога с клиентом
- Бесконечные трансляции с ведущим
- Интерактивные персонажи
- Размеры
- 14B
- Железо
- от: 1 видеокарта
МедицинаGGUF2025–2026
Alibaba DAMO Academy · Китай
Медицинская модель Alibaba на основе Qwen2.5-VL: понимает снимки разных типов и медицинский текст, умеет рассуждать по шагам. Не заменяет врача, решения принимает специалист.
- Подсказки при разборе снимков для врача
- Черновики заключений и выписок
- Поиск по медицинской литературе
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
МедицинаGGUF2025–2026
Ant Healthcare (Ant Group) и Центр медицинской информации провинции Чжэцзян · Китай
Крупная медицинская MoE-модель на базе Ling-flash-2.0: 100B параметров, из них в работе 6B, поэтому отвечает быстро. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу по клиническим вопросам
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 100B-A6B
- Железо
- от: 1 видеокарта
Поиск и RAGRUOllama2025–2026
Alibaba (Qwen) · Китай
Эмбеддинги и реранкеры на базе Qwen3, в числе лучших открытых для многоязычного поиска, включая русский. VL-версии ищут по картинкам, скриншотам и видео.
- Поиск по базе знаний для RAG
- Переранжирование найденного перед ответом
- Поиск по сканам, слайдам и скриншотам
- Размеры
- 0.6B – 8B
- Железо
- от: Ноутбук
Поиск и RAG2026
Voyage AI (MongoDB) · США
Единственная открытая модель линейки Voyage 4: её векторы совместимы с платными старшими версиями, можно начать локально и позже перейти на API.
- Поиск по документам на своём сервере
- RAG для небольших баз знаний
- Поиск похожих текстов
- Размеры
- около 340M
- Железо
- от: Ноутбук
Синтез речиRUGGUF2026
Alibaba (Qwen) · Китай
Синтез речи на 10 языках, включая русский: клонирование голоса по 3 секундам, готовые голоса и создание голоса по текстовому описанию.
- Голос для бота и ассистента
- Клонирование фирменного голоса
- Подбор голоса по описанию
- Размеры
- 0.6B – 1.7B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Microsoft · США
Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.
- Ассистент на ноутбуке или своём сервере
- Задачи с рассуждением и расчётами
- Разбор изображений и схем (vision-версии)
- Размеры
- 1.3B – 42B-A6.6B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
Allen Institute for AI (Ai2) · США
Полностью открытые модели: опубликованы не только веса, но и данные, код обучения и промежуточные снимки. Удобно, когда важна прозрачность происхождения.
- Ассистент и ответы по документам
- Задачи с рассуждением (версии Think)
- Дообучение под свои данные с понятной историей модели
- Размеры
- 1B – 32B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
Prime Intellect · США
Модели, обученные распределённо на видеокартах со всего мира. INTELLECT-3 на 106B дообучена с подкреплением для математики, кода и агентов.
- Задачи с рассуждением и математикой
- Помощь в программировании
- Агенты с вызовом инструментов
- Размеры
- 10B – 106B-A12B
- Железо
- от: 1 видеокарта
ТекстRUGGUF2024–2026
Консорциум UTTER (Unbabel, университеты Лиссабона, Эдинбурга, Амстердама и др.) · Евросоюз
Европейские языковые модели, обученные на всех языках ЕС и ряде других, с упором на перевод. Русский есть. Свободная лицензия.
- Перевод и локализация текстов
- Ответы на вопросы на разных языках
- Черновики писем для зарубежных партнёров
- Размеры
- 1.7B – 22B
- Железо
- от: Ноутбук
Документы и OCROllama2025–2026
DeepSeek · Китай
OCR-модель, которая сильно сжимает страницу в небольшое число визуальных токенов, поэтому быстро обрабатывает большие объёмы. Версия 2 лучше понимает порядок чтения.
- Массовое распознавание сканов счетов и договоров
- Распознавание таблиц
- Перевод PDF в Markdown для поиска и RAG
- Размеры
- около 3B
- Железо
- от: Ноутбук
Документы и OCRRUOllama2026
Zhipu AI (Z.ai) · Китай
Лёгкая OCR-модель Zhipu для разбора документов. В карточке русский указан среди поддерживаемых языков; рассчитана на высокую нагрузку и слабое железо.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Распознавание таблиц и формул
- Извлечение полей в JSON
- Размеры
- 0.9B
- Железо
- от: Ноутбук
Документы и OCRGGUF2025–2026
LightOn · Франция
Французская OCR-модель на 1B, которая переводит страницу в текст за один проход и быстро работает на потоке. Языки в карточке — европейские, китайский и японский, русского нет.
- Распознавание счетов и договоров на европейских языках
- Распознавание таблиц
- Перевод PDF в текст для поиска и RAG
- Размеры
- 0.9B – 1B
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2026
Meituan · Китай
Агент Meituan для управления компьютером, обученный на большом числе смоделированных задач в настольных программах. На выходе даёт клики и ввод с клавиатуры.
- Работа в офисных и старых программах без API
- Перенос данных между системами
- Прогон сценариев для тестов
- Размеры
- 8B – 32B
- Железо
- от: 1 видеокарта
Голос: спикеры и звукRU2025–2026
Daily (Pipecat) · США
Определяет по интонации, закончил ли человек мысль или просто сделал паузу, чтобы голосовой бот не перебивал. Версия 3 весит 8 МБ, работает на процессоре и понимает 23 языка, включая русский.
- Голосовой бот не перебивает клиента на паузах
- Быстрый ответ, когда клиент действительно договорил
- Дополнение к обычному детектору речи в голосовых ассистентах
- Размеры
- 8M (v3) – 580M (v1)
- Железо
- от: Ноутбук
ВидеоGGUF2026
OpenMOSS / MOSI · Китай
Генерирует видео сразу со звуком: речь с синхронными губами, эффекты и окружение в одном проходе. MoE-архитектура на 32B параметров, есть версии 360p и 720p.
- Короткие ролики с речью и звуком по описанию
- Рекламные сцены с диалогами
- Прототипы видео для сторибордов
- Размеры
- 32B-A18B
- Железо
- от: 1 видеокарта
Погода и климат2024–2026
Европейский центр среднесрочных прогнозов погоды (ECMWF) · Европа (межправительственная организация)
Погодная нейросеть ECMWF, которая работает в оперативном режиме: прогноз на 15 дней четыре раза в сутки, ансамблевая версия на 51 сценарий, с версии 2 — волнение моря.
- Собственный запуск прогноза от открытых начальных данных
- Ансамблевые прогнозы для оценки вероятности заморозков, ливней, штормов
- Прогноз волнения для морских операций
- Размеры
- чекпоинт около 1 ГБ
- Железо
- от: 1 видеокарта
3DGGUF2024–2025
Microsoft · США
Одна из сильнейших открытых 3D-моделей: по картинке или тексту выдаёт сетку с текстурой или гауссову сцену. TRELLIS.2 заметно детальнее первой версии.
- 3D-модели товаров и интерьера по фото
- Ассеты для игр и AR/VR
- Прототипы для 3D-печати
- Размеры
- до 4B (TRELLIS.2)
- Железо
- от: 1 видеокарта
Речь в текстRU2025
Meta · США
Распознавание речи на 1600+ языках, включая русский и редкие языки, которые раньше не поддерживала ни одна система. Новый язык можно добавить по нескольким примерам.
- Расшифровка на редких и местных языках
- Оцифровка устных архивов
- Субтитры на многих языках
- Размеры
- 300M – 7B
- Железо
- от: Ноутбук
Синтез речиRU2024–2025
Alibaba (Tongyi, FunAudioLLM) · Китай
Синтез речи с клонированием голоса по короткому образцу и потоковой выдачей для живого диалога. Третья версия поддерживает 9 языков, включая русский.
- Голос для бота и ассистента
- Клонирование фирменного голоса
- Озвучка роликов
- Размеры
- 300M – 0.5B
- Железо
- от: Ноутбук
ТекстRUGGUF2024–2025
Vikhr Models · Россия
Русскоязычные дообучения открытых моделей (Mistral, Qwen, Llama) от независимой команды Vikhr: улучшают русский язык, есть компактные версии для обычного ПК. Borealis — аудио-модель для распознавания и понимания русской речи.
- Русскоязычный ассистент на своём ПК или сервере
- Ответы по базе знаний (RAG)
- Тексты и письма на русском
- Размеры
- 0.5B – 24B
- Железо
- от: Ноутбук
Картинка + текст2023–2025
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Модели зрения от Zhipu: сначала CogVLM, затем линейка GLM-V. GLM-4.6V умеет вызывать инструменты по картинкам и работать как агент с интерфейсом.
- Ответы на вопросы по фото и документам
- Агент, работающий с интерфейсом по скриншотам
- Разбор графиков и отчётов
- Размеры
- 9B – 106B-A12B
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025
Alibaba (Tongyi-MAI) · Китай
Компактные модели Alibaba для работы в интерфейсе смартфона и компьютера: находят элементы и выполняют многошаговые задачи. Малый размер позволяет запуск на обычной видеокарте.
- Автоматизация действий в мобильных приложениях
- Работа в программах без API
- Автотесты интерфейсов
- Размеры
- 2B – 8B
- Железо
- от: Ноутбук
Модерация и безопасность2025
ServiceNow · США
Guard-модель, которая ловит и опасный контент, и атаки на ИИ (prompt injection, джейлбрейки), в том числе в работе агентов с инструментами.
- Проверка запросов к чат-боту на атаки и взлом
- Фильтр опасных ответов модели
- Контроль действий ИИ-агента с инструментами
- Размеры
- 8B
- Железо
- от: Ноутбук
ТекстGGUF2023–2025
Inception (G42), MBZUAI и Cerebras · ОАЭ
Семейство моделей для арабского и английского языков, включая диалекты Персидского залива. Подходит компаниям, работающим с арабоязычными клиентами и госструктурами региона.
- Чат-бот на арабском и английском
- Перевод и пересказ документов на арабском
- Классификация обращений клиентов
- Размеры
- 256M – 70B
- Железо
- от: Ноутбук
3D2025
Meta и Университет Карнеги — Меллон · США
Одна модель собирает метрическую 3D-реконструкцию из фото, а если есть данные о камерах, глубине или позах — учитывает и их. Есть версия весов под Apache 2.0.
- 3D-реконструкция объекта или помещения по фото
- Экспорт сцены в формат COLMAP для дальнейшей обработки
- Оценка глубины и положения камер
- Размеры
- около 1.2B
- Железо
- от: 1 видеокарта
Компьютерное зрение2025
Meta · США
Семейство энкодеров Meta для картинок и видео, а с версией PE-AV — и для звука. PE-Core ищет по тексту точнее SigLIP 2 (по данным Meta), есть малые версии.
- Поиск фото и видео по описанию
- Разметка и теги каталога
- Поиск по звуку и видео (PE-AV)
- Размеры
- размер на карточке не указан
- Железо
- от: Ноутбук
Табличные данныеGGUF2024–2025
Чжэцзянский университет · Китай
Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.
- Ответы на вопросы по таблицам и выгрузкам
- Автоматический разбор данных с написанием кода
- Помощник в BI и внутренней отчётности
- Размеры
- 7B – 72B
- Железо
- от: 1 видеокарта
Детекция подделок2024–2025
Meta · США
Водяной знак для видео и картинок, устойчивый к перекодированию и обрезке. Детектор ошибается в обе стороны: отсутствие метки не доказывает подделку, а её находка — повод для проверки человеком.
- Пометка видео, созданного или обработанного ИИ
- Поиск своей метки в перезалитых роликах
- Защита рекламных материалов от переприсвоения
- Размеры
- метка от 96 до 1024 бит
- Железо
- от: Ноутбук
Синтез речи2025
Nari Labs · Южная Корея
Модель, которая озвучивает целые диалоги на два голоса со смехом, вздохами и паузами. Только английский.
- Озвучка диалогов и подкастов
- Рекламные ролики с живой речью
- Сценки для обучения
- Размеры
- 1B – 2B
- Железо
- от: Ноутбук
Голос: спикеры и звукRU2020–2025
Silero · Россия
Самый популярный открытый детектор речи: отличает голос от тишины и шума. Обрабатывает фрагмент звука меньше чем за миллисекунду на одном ядре процессора, обучен на записях более чем 6000 языков.
- Нарезка звонков и записей перед распознаванием речи
- Определение, когда клиент говорит, в голосовом боте
- Отсев тишины и шума, экономия на расшифровке
- Размеры
- около 2 МБ
- Железо
- от: Ноутбук
Видео2025
Character.AI · США
Генерирует видео вместе со звуком и речью по тексту или картинке: две ветви (видео на базе Wan 2.2 и аудио 5B) работают синхронно. Нужно 24–32 ГБ видеопамяти.
- Короткие ролики с говорящими персонажами
- Оживление картинки с озвучкой
- Прототипы рекламных сцен
- Размеры
- 11B
- Железо
- от: 1 видеокарта
Спутниковые снимки и гео2025
IBM и Европейское космическое агентство (ESA) · США / Европа
Мультимодальная модель Земли: понимает оптические и радарные снимки, рельеф, индекс растительности и карты землепользования, умеет достраивать недостающий тип данных (например, «снимок сквозь облака» по радару).
- Анализ полей и лесов даже в облачную погоду по радарным снимкам
- Карты землепользования для оценки участков
- Оценка паводков и пожаров (есть готовые дообучения)
- Размеры
- tiny – large (чекпоинты от ~200 МБ до ~3,8 ГБ)
- Железо
- от: Ноутбук
Реранкеры2025
ZeroEntropy · США
Реранкеры на базе Qwen3. В карточке перечислены рабочие области — финансы, право, код, медицина, наука; язык указан английский.
- Уточнение выдачи перед ответом ИИ-помощника
- Сортировка результатов поиска по договорам и отчётам
- Поиск по технической и научной документации
- Размеры
- zerank-2 — 4B (на базе Qwen3-4B), есть уменьшенная версия small
- Железо
- от: Ноутбук
ВидеоGGUF2025
Meituan · Китай
Видеомодель на 13.6B: из текста, из картинки и продолжение видео. Держит качество на роликах в несколько минут.
- Длинные ролики
- Видео из фото
- Продолжение готового видео
- Размеры
- 13.6B
- Железо
- от: 1 видеокарта
ПрогнозыGGUF2024–2025
Amazon · США
Модели прогнозов Amazon, одни из самых скачиваемых. Chronos-2 учитывает внешние факторы: цены, акции, погоду.
- Прогноз спроса с учётом акций и цен
- Планирование запасов
- Прогноз выручки и потоков клиентов
- Размеры
- 8M – 710M
- Железо
- от: Ноутбук
Музыка и звук2025
ASLP-lab (Северо-Западный политехнический университет) · Китай
Быстрая генерация полной песни с вокалом по тексту и образцу стиля, до нескольких минут звучания.
- Песни и джинглы по тексту
- Музыка для роликов
- Демо-версии композиций
- Размеры
- около 1.1B
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2025
OpenAI · США
Модерация по вашим правилам: политику пишете обычным текстом, модель рассуждает и выносит решение с объяснением. Построена на gpt-oss.
- Модерация по внутренним правилам компании
- Разметка спорных сообщений с объяснением
- Проверка отзывов и объявлений перед публикацией
- Размеры
- 20B – 120B
- Железо
- от: 1 видеокарта
Картинка + текстOllama2023–2025
Alibaba (команда Qwen) · Китай
Одна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.
- Извлечение данных из сканов счетов и накладных
- Разбор фотографий товаров и витрин
- Анализ видео и записей с камер
- Размеры
- 2B – 235B-A22B
- Железо
- от: Ноутбук
Документы и OCRGGUF2025
Ai2 (Allen Institute for AI) · США
Модель и набор инструментов для массового перевода PDF в чистый текст с сохранением порядка чтения, таблиц и формул. Рассчитана на обработку миллионов страниц.
- Массовая оцифровка архива PDF
- Распознавание договоров и отчётов в текст
- Подготовка документов для поиска и RAG
- Размеры
- 7B
- Железо
- от: 1 видеокарта
Биология и химия2024–2025
MIT (Jameel Clinic) и Recursion · США
Открытая альтернатива AlphaFold 3 под MIT: предсказывает структуру комплексов белков, ДНК и малых молекул, Boltz-2 оценивает силу связывания, BoltzGen проектирует новые связывающие белки.
- Предсказание, как молекула-кандидат садится в белок-мишень
- Ранжирование соединений по прогнозу силы связывания до синтеза
- Проектирование белков-связывателей под заданную мишень
- Размеры
- чекпоинты около 2 ГБ
- Железо
- от: 1 видеокарта
Поиск и RAGRUOllama2024–2025
Mixedbread · Германия
Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.
- Поиск по базе знаний
- Переранжирование результатов перед ответом бота
- Поиск по каталогу товаров
- Размеры
- 17M – 1.5B
- Железо
- от: Ноутбук
Поиск по сканам документов2025
Illuin Technology, EPFL, CentraleSupélec · Франция
Компактная (250M) модель для поиска по страницам документов как по картинкам. По данным авторов, не уступает моделям в 10 раз крупнее и работает без видеокарты.
- Поиск по сканам и PDF на слабом сервере
- Индексация архивов документов
- Поиск по слайдам и инструкциям
- Размеры
- 250M
- Железо
- от: Ноутбук
ТекстRU2025
Авито Тех · Россия
Модель Авито на базе Qwen3-8B, переученная под русский язык: свой токенизатор, русские тексты быстрее на 15–25%. Умеет вызывать функции.
- Описания товаров и объявлений на русском
- Чат-бот с вызовом внутренних сервисов
- Разбор и классификация обращений
- Размеры
- 7.9B
- Железо
- от: Ноутбук
Картинка + текстRU2025
Авито Тех · Россия
Русскоязычная модель Авито, которая понимает картинки: описывает фото, отвечает на вопросы по изображению, читает надписи. Основа Qwen2.5-VL, на русском быстрее исходной.
- Описание товара по фото на русском
- Проверка, что фото совпадает с описанием
- Чтение брендов и надписей на картинках
- Размеры
- 7.4B
- Железо
- от: 1 видеокарта
Речь в текстRU2023–2025
Alpha Cephei · Россия
Офлайн-распознавание русской речи, которое работает даже на Raspberry Pi и телефоне, без интернета. Есть потоковые модели для живого звука и простой русский синтез речи Vosk TTS.
- Расшифровка звонков и записей на русском без облака
- Голосовое управление в приложениях и киосках
- Распознавание речи в потоке с малой задержкой
- Размеры
- около 45 МБ – 1,8 ГБ
- Железо
- от: Ноутбук
Голосовые ассистентыRUGGUF2025
Alibaba (Qwen) · Китай
Модели, которые понимают текст, картинки, аудио и видео и отвечают голосом в реальном времени. Qwen3-Omni говорит на 10 языках, включая русский.
- Голосовой ассистент для клиентов
- Разбор звонков и видео
- Ответы голосом по документам и картинкам
- Размеры
- 3B – 30B-A3B
- Железо
- от: Ноутбук
Модерация и безопасностьRUGGUF2025
Alibaba (Qwen) · Китай
Фильтры безопасности на 119 языков, русский в их числе. Версия Stream проверяет ответ бота прямо во время его генерации и может оборвать его на лету.
- Фильтр запросов к боту на русском
- Остановка опасного ответа во время генерации
- Разметка сообщений по категориям риска
- Размеры
- 0.6B – 8B
- Железо
- от: Ноутбук
Документы и OCR2025
IBM и Hugging Face · США
Крошечные модели для открытого конвертера документов Docling: переводят страницу в разметку с таблицами, формулами и кодом. Работают на обычном ноутбуке.
- Перевод PDF и сканов в Markdown для поиска и RAG
- Распознавание таблиц из отчётов
- Разбор счетов и договоров на обычном ПК
- Размеры
- 256M – 258M
- Железо
- от: Ноутбук
Голос: спикеры и звук2022–2025
pyannoteAI (Эрве Бредин) · Франция
Самый распространённый открытый инструмент, который размечает запись по спикерам: кто и когда говорил. Обычно ставится в связку с распознаванием речи. Веса выдаются после короткой анкеты на HF.
- Разметка звонков: где оператор, где клиент
- Протоколы совещаний с подписью спикеров
- Подготовка записей к расшифровке и анализу
- Размеры
- несколько миллионов параметров
- Железо
- от: Ноутбук
Спутниковые снимки и гео2023–2025
IBM и NASA · США
Базовые модели для спутниковых снимков Landsat и Sentinel-2 с учётом серии снимков во времени. Есть готовые дообучения под наводнения, гари и типы культур, плюс отдельная погодная модель WxC.
- Карта посевов и состояния полей по сезону
- Оценка зон затопления и гарей после стихийных событий
- Мониторинг изменений застройки и землепользования
- Размеры
- tiny – 600M (снимки), 2,3B (погода Prithvi WxC)
- Железо
- от: Ноутбук
Поиск и RAGOllama2023–2025
BAAI (Пекинская академия ИИ) · Китай
Одни из самых популярных эмбеддингов для поиска и RAG. Основные версии v1.5 рассчитаны на английский и китайский; для русского у BAAI есть отдельная bge-m3.
- Поиск по документам на английском
- Подбор фрагментов для ответа чат-бота (RAG)
- Поиск по коду (bge-code)
- Размеры
- 24M – 9B
- Железо
- от: Ноутбук
Текст в SQLGGUF2024–2025
Prem AI · Великобритания
Модель текст-в-SQL всего на 1B параметров: задумана для локального запуска, чтобы база данных не уходила во внешние сервисы.
- Локальный перевод вопросов в SQL без выхода в интернет
- Подсказки по запросам на слабом железе
- Встраивание в внутренние инструменты аналитики
- Размеры
- 1B
- Железо
- от: Ноутбук
ТекстOllama2025
OpenAI · США
Первые открытые модели OpenAI со времён GPT-2. Рассуждения, вызов инструментов, младшая версия помещается на одну видеокарту.
- ИИ-агент с вызовом внутренних систем
- Ответы по регламентам
- Черновики писем и отчётов
- Размеры
- 20B, 120B
- Железо
- от: 1 видеокарта
Аватары2025
Meituan · Китай
Дубляж и говорящие персонажи на базе Wan: MultiTalk ведёт диалог нескольких людей, InfiniteTalk переозвучивает видео любой длины с мимикой и телом.
- Дубляж видео с подгонкой мимики
- Диалог двух персонажей по аудио
- Длинные ролики с ведущим
- Размеры
- 14B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Moonshot AI и Project Numina · Китай, Франция
Модели для формальных доказательств в Lean 4 от Moonshot AI (Kimi) и Numina. Есть маленькие версии от 0.6B, которые запускаются на ноутбуке.
- Формальная проверка математических выкладок
- Перевод задачи с обычного языка на Lean
- Обучение и олимпиадная подготовка
- Размеры
- 0.6B – 72B
- Железо
- от: Ноутбук
ТекстRU2024–2025
НИВЦ МГУ, лаборатория LAIR (RefalMachine) · Россия
Модели Qwen, переделанные под русский язык: заменён токенизатор и проведено дообучение на русских текстах. За счёт этого русский текст генерируется до двух раз быстрее, чем у исходной модели того же размера.
- Русскоязычный ассистент на своём сервере
- Ответы по документам компании (RAG) на русском
- Разбор и пересказ длинных русских текстов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
ТекстGGUF2025
ByteDance · Китай
Открытая модель ByteDance на 36B с контекстом до 512 тыс. токенов и настраиваемым «бюджетом размышлений». Помещается на одну мощную видеокарту.
- Разбор длинных документов
- Агенты с инструментами
- Корпоративный ассистент
- Размеры
- 36B
- Железо
- от: 1 видеокарта
Голос: спикеры и звук2024–2025
Alibaba (Tongyi Lab) · Китай
Набор моделей Alibaba для чистки речи: шумоподавление, разделение наложенных голосов, повышение качества звука до 48 кГц и выделение голоса по видео с лицом говорящего.
- Шумоподавление записей разговоров
- Разделение двух голосов, говорящих одновременно
- Улучшение старых и телефонных записей
- Размеры
- менее 1B
- Железо
- от: Ноутбук
МедицинаGGUF2025
Intelligent Internet · Великобритания
Рассуждающие медицинские модели на Qwen3, которые рассчитаны на запуск на обычном компьютере. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу с ходом рассуждения
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Речь в текстRU2025
Т-Банк · Россия
Компактная потоковая модель Т-Банка для распознавания русской речи в телефонных разговорах. Работает в реальном времени даже без видеокарты.
- Расшифровка телефонных звонков
- Голосовые роботы на линии
- Контроль качества разговоров
- Размеры
- 72M
- Железо
- от: Ноутбук
ТекстRUOllama2024–2025
Hugging Face · США
Крошечные открытые модели Hugging Face для телефонов и ноутбуков. SmolLM3 на 3B умеет рассуждать и держит длинный контекст, весь рецепт обучения открыт.
- Простой ассистент прямо на устройстве
- Классификация и маршрутизация обращений
- Основа для дообучения под узкую задачу
- Размеры
- 135M – 3B
- Железо
- от: Ноутбук
ПереводRUGGUF2025
ByteDance Seed · Китай
Компактный переводчик ByteDance на 28 языков, по качеству близкий к крупным закрытым системам. Русский есть. Есть готовые сжатые версии.
- Перевод деловой переписки и документов
- Перевод карточек товаров
- Перевод технических и юридических текстов
- Размеры
- 7B
- Железо
- от: Ноутбук
Обработка фотоGGUF2024–2025
Нанькайский университет · Китай
Открытая модель точного выделения объекта и удаления фона под лицензией MIT. На ней построен RMBG-2.0. Есть версии для 2K и для волос и полупрозрачных краёв.
- Удаление фона с фото товаров потоком
- Точные маски для дизайна и печати
- Вырезка людей с волосами для рекламы
- Размеры
- около 220M (есть облегчённые lite)
- Железо
- от: Ноутбук
Финансы2025
Университет Цинхуа (NeoQuasar) · Китай
Базовая модель для биржевых свечей: обучена на данных более 45 бирж и прогнозирует цены и объёмы. Крупнейшая версия large не открыта.
- Прогноз свечей и объёмов торгов
- Оценка волатильности
- Основа для дообучения на своих рядах
- Размеры
- 4.1M – 102M
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025
Agentica (Беркли, Sky Computing Lab) и Together AI · США
Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.
- Решение математических задач с пошаговым выводом
- Генерация и проверка кода
- Агент для исправления ошибок в репозитории
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Детекция подделок2024–2025
Meta · США
Водяной знак для картинок, который можно поставить на отдельные участки: модель показывает, какая часть изображения помечена. Ошибается в обе стороны — итог проверяет человек.
- Пометка сгенерированных и отредактированных изображений
- Поиск помеченного фрагмента в коллаже
- Отслеживание, какие части картинки сделал ИИ
- Размеры
- кодировщик и декодировщик метки для изображений
- Железо
- от: Ноутбук
Проверка фактов и оценка ответов2024–2025
OpenCompass (Шанхайская лаборатория ИИ) · Китай
Линейка судей от команды открытых тестов моделей: оценивают ответы и сверяют их с эталоном. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.
- Оценка ответов моделей по заданным критериям
- Сверка ответа с эталонным решением
- Сравнение нескольких моделей на своих данных
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
КартинкиGGUF2024–2025
BAAI (Пекинская академия ИИ) · Китай
Универсальная модель: генерирует, редактирует, переносит объект или человека с фото в новую сцену без отдельных плагинов.
- Перенос товара или человека в новую сцену
- Редактирование фото по инструкции
- Генерация по нескольким референсам
- Размеры
- около 4B
- Железо
- от: 1 видеокарта
Роботы2025
Hugging Face · США
Маленькая модель управления роботом, которая работает на обычном ноутбуке. Обучена на открытых данных сообщества LeRobot, подходит для недорогих манипуляторов.
- Управление недорогим манипулятором
- Быстрые пилоты и демо роботизации
- Обучение персонала и студентов
- Размеры
- 450M
- Железо
- от: Ноутбук
Обработка фото2025
ByteDance Seed · Китай
Восстановление и увеличение видео и фото от ByteDance. SeedVR2 делает это за один шаг, поэтому заметно быстрее похожих моделей. Коммерческая лицензия.
- Увеличение фото и видео до 2K–4K
- Восстановление старых роликов и снимков
- Улучшение пользовательских фото перед публикацией
- Размеры
- 3B – 7B
- Железо
- от: 1 видеокарта
Картинка + текстGGUF2025
Moonshot AI · Китай
Экономичная MoE-модель зрения (16B, активны 3B) с длинным контекстом и рассуждающей версией. Хорошо разбирает длинные документы и видео.
- Разбор длинных PDF и презентаций
- Ответы на вопросы по видео
- Работа с интерфейсами по скриншотам
- Размеры
- 16B-A3B
- Железо
- от: 1 видеокарта
Голос: спикеры и звук2024–2025
RVC-Boss и сообщество · Китай
Синтез речи с клонированием голоса: хватает 5 секунд образца, а после дообучения на минуте записи голос звучит заметно точнее. Использовать только с согласия владельца голоса.
- Озвучка текстов голосом конкретного диктора
- Голос для бота или ассистента
- Дубляж обучающих роликов
- Размеры
- менее 1B
- Железо
- от: Ноутбук
Спутниковые снимки и гео2025
MBZUAI · ОАЭ
Компактная исследовательская модель для спутниковых снимков: обучена сразу на оптических (Sentinel-2) и радарных (Sentinel-1) данных. Меньше по охвату и сообществу, чем Prithvi и TerraMind.
- Классификация и сегментация спутниковых снимков после дообучения
- Основа для прототипа мониторинга территорий
- Размеры
- TerraFM-B (ViT-Base)
- Железо
- от: Ноутбук
КибербезопасностьGGUF2023–2025
Clouditera · Китай
Китайское открытое семейство для кибербезопасности: разбор уязвимостей, анализ логов и трафика, объяснение команд и скриптов.
- Разбор уязвимостей и подготовка рекомендаций по исправлению
- Анализ логов и восстановление цепочки атаки
- Объяснение подозрительных команд и скриптов
- Размеры
- 1.5B – 14B
- Железо
- от: Ноутбук
КибербезопасностьGGUF2025
Trendyol · Турция
Модели безопасности от крупного турецкого маркетплейса, выложены в формате GGUF: разбор алертов и инцидентов, английский и турецкий языки.
- Разбор алертов и первичная оценка инцидента
- Объяснение подозрительной активности в отчётах
- Помощь дежурной смене центра мониторинга
- Размеры
- 32B и 70B
- Железо
- от: 1 видеокарта
Текст в SQLGGUF2025
IDEA Research · Китай
Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.
- Запросы к базе по вопросам с несколькими условиями
- Разбор и исправление чужих SQL-запросов
- Помощник аналитика в BI-системе
- Размеры
- 3B – 14B
- Железо
- от: Ноутбук
Поиск и RAGGGUF2024–2025
TechWolf · Бельгия
Модель бельгийской HR-компании: превращает названия должностей в векторы, чтобы находить похожие вакансии и резюме. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Сопоставление названий должностей из разных источников
- Поиск похожих вакансий и резюме по смыслу
- Наведение порядка в справочнике должностей компании
- Размеры
- 109M – 278M
- Железо
- от: Ноутбук
ТекстOllama2025
DeepSeek · Китай
Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.
- Сложные расчёты и проверка логики
- Анализ договоров и регламентов
- Помощь программистам
- Размеры
- 1,5B – 671B
- Железо
- от: Ноутбук
КодGGUF2025
ByteDance Seed · Китай
Компактная модель для кода 8B от ByteDance: базовая, инструктивная и рассуждающая версии. Данные для обучения отбирала сама модель, почти без ручных правил.
- Автодополнение и генерация кода
- Решение алгоритмических задач
- Основа для дообучения под свой стек
- Размеры
- 8B
- Железо
- от: Ноутбук
КартинкиGGUF2025
ByteDance Seed · Китай
Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.
- Редактирование фото в диалоге
- Ответы на вопросы по изображению
- Генерация картинок с пояснениями
- Размеры
- 14B-A7B
- Железо
- от: 1 видеокарта
Разбор текстаRU2023–2025
deepvk (VK) · Россия
Русские энкодеры от команды VK: RuModernBERT читает длинные тексты, USER даёт векторы для поиска, GeRaCl классифицирует тексты по темам без обучения.
- Классификация обращений без размеченных данных
- Поиск по базе знаний на русском
- Разбор длинных договоров
- Размеры
- 35M – 360M
- Железо
- от: Ноутбук
Текст в SQL2025
Snowflake · США
Модель Snowflake для перевода вопросов в SQL, обученная с подкреплением на проверке результата запроса. Открыта версия 7B на базе Qwen2.5-Coder.
- Вопросы к хранилищу данных на обычном языке
- Генерация SQL для отчётов и дашбордов
- Проверка и исправление запросов аналитиков
- Размеры
- 7B
- Железо
- от: Ноутбук
КодRU2025
МТС AI (MWS AI) · Россия
Маленький помощник программиста от МТС AI, понимает запросы на русском. Работает локально, есть плагины для VS Code и JetBrains.
- Подсказки и дописывание кода в редакторе
- Объяснение кода на русском
- Черновики тестов и документации
- Размеры
- 1.5B
- Железо
- от: Ноутбук
Прогнозы2025
THUML, Университет Цинхуа · Китай
Модель прогнозов, которая выдаёт не одну линию, а набор возможных сценариев — удобно, когда нужен коридор спроса или нагрузки, а не одно число.
- Прогноз спроса с коридором значений
- Планирование запасов с учётом разброса
- Прогноз нагрузки на сервисы и персонал
- Размеры
- 128M (sundial-base)
- Железо
- от: Ноутбук
Картинка + текстGGUF2024–2025
Hugging Face · Франция / США
Самые маленькие модели зрения Hugging Face: от 256M, работают в браузере и на телефоне. SmolVLM2 понимает и видео.
- Описание фото и видео на слабом железе
- Чтение простых документов
- Встраивание в мобильные и офлайн-приложения
- Размеры
- 256M – 2.2B
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025
ByteDance Seed · Китай
Модель, которая смотрит на скриншот и сама двигает мышью и клавиатурой: кликает, заполняет поля, переходит по меню. Открыты 1-е поколение и 1.5-7B; UI-TARS-2 весов не открыл.
- Работа в старых программах без API
- Заполнение форм и перенос данных между системами
- Автотесты интерфейсов по сценарию на обычном языке
- Размеры
- 2B – 72B
- Железо
- от: Ноутбук
Текст в SQL2025
Alibaba · Китай
Модели Alibaba для перевода вопросов в SQL на базе Qwen2.5-Coder. Работают с разными диалектами SQL, есть малая версия 3B для слабого железа.
- Вопросы к базе на обычном языке
- Запросы к разным СУБД (PostgreSQL, MySQL, SQLite)
- Автоматизация типовых отчётов
- Размеры
- 3B – 32B
- Железо
- от: Ноутбук
Модерация и безопасность2023–2025
Falconsai и Freepik · США и Испания
Небольшие модели, которые отличают откровенные картинки от обычных. Freepik различает четыре уровня откровенности. Работают на процессоре.
- Фильтр пользовательских фото и аватаров
- Проверка картинок от генераторов перед публикацией
- Разметка медиатеки
- Размеры
- 86M
- Железо
- от: Ноутбук
Голосовые ассистенты2025
Moonshot AI · Китай
Универсальная аудиомодель: распознаёт речь, отвечает на вопросы о звуке, определяет эмоции и ведёт голосовой диалог. Обучена на 13 млн часов аудио, языки — английский и китайский.
- Распознавание речи
- Определение эмоций и звуковых событий
- Голосовой диалог речь-в-речь
- Размеры
- 7B
- Железо
- от: 1 видеокарта
Речь в текстRUGGUF2022–2025
OpenAI · США
Распознавание речи на 99 языках, включая русский. Стандарт де-факто для расшифровки звонков и встреч. Ускоренные Distil-Whisper от Hugging Face — только для английского.
- Расшифровка звонков и созвонов
- Субтитры к видео
- Голосовые сообщения в текст
- Размеры
- 39M – 1,5B
- Железо
- от: Ноутбук
КартинкиGGUF2024–2025
NVIDIA · США
Быстрая модель картинок от NVIDIA: 4K-изображения за секунды и работа даже на ноутбучной видеокарте. Версия Sprint генерирует в 1–2 шага.
- Массовая генерация картинок
- Визуалы высокого разрешения
- Генерация в реальном времени в приложениях
- Размеры
- 0.6B – 4.8B
- Железо
- от: Ноутбук
Видео2024–2025
HPC-AI Tech · Сингапур
Полностью открытый проект видеогенерации: веса, код и рецепт обучения. Версия 2.0 на 11B делает видео из текста и из картинки.
- Видео по текстовому описанию
- Оживление картинок
- Обучение своей видеомодели
- Размеры
- до 11B
- Железо
- от: 1 видеокарта
Видео2025
StepFun · Китай
Крупная видеомодель на 30B с роликами до 204 кадров. Требует серверного железа, зато открыта под MIT.
- Видео по описанию
- Оживление изображений
- Размеры
- 30B
- Железо
- от: Кластер
Аватары2024–2025
Tencent Music (Lyra Lab) · Китай
Синхронизация губ в реальном времени: подгоняет рот на видео под новое аудио. Подходит для перевода видео и живых аватаров.
- Дубляж видео на другой язык
- Живой аватар в видеочате
- Правка речи в готовом ролике
- Размеры
- меньше 1B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики договоров и регламентов
- Размеры
- 32B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Стэнфордский университет · США
Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.
- Расчёты и проверка формул
- Разбор сложных задач по шагам
- Обучение
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
Qihoo 360 · Китай
Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024–2025
Nomic AI · США
Полностью открытые эмбеддинги — с весами, данными и кодом обучения. v2 многоязычная на MoE, есть версии для кода и для поиска по PDF-страницам.
- Поиск по документам и базе знаний
- Поиск по коду
- Поиск по сканам и PDF без распознавания
- Размеры
- 137M – 7B
- Железо
- от: Ноутбук
Синтез речиGGUF2025
Canopy Labs · США
Синтез речи на основе языковой модели с живыми интонациями и эмоциональными вставками. Быстро отвечает, подходит для голосовых ассистентов. В основном английский.
- Голос для ассистента в реальном времени
- Эмоциональная озвучка
- Клонирование голоса
- Размеры
- 3B
- Железо
- от: Ноутбук
Синтез речиGGUF2025
Sesame · США
Модель разговорной речи, которая учитывает контекст беседы и звучит как живой собеседник. Только английский.
- Голос для разговорного ассистента
- Озвучка диалогов
- Прототипы голосовых продуктов
- Размеры
- 1B
- Железо
- от: Ноутбук
Текст в SQL2025
Renmin University of China (RUC) · Китай
Модели для перевода вопросов в SQL, обученные на миллионах синтетических примеров запросов к разным базам. Три размера под разное железо.
- Вопросы к базе данных без знания SQL
- Генерация запросов для отчётов
- Основа для дообучения под свою схему базы
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Финансы2025
Шанхайский университет финансов и экономики (SUFE) · Китай
Модель с рассуждениями для финансовых задач на базе Qwen2.5-7B: расчёты, разбор отчётов, вопросы по регулированию. Обучена на китайских и английских данных.
- Финансовые расчёты с пошаговым объяснением
- Ответы на вопросы по отчётности
- Разбор таблиц с финансовыми данными
- Размеры
- 7B
- Железо
- от: Ноутбук
Детекция подделок2025
Desklib · Индия
Свежий открытый детектор ИИ-текста на DeBERTa-v3-large, обучен на наборе RAID; есть отдельная версия под учебные работы. Ошибается в обе стороны — итог всегда проверяет человек.
- Проверка присланных статей и отчётов
- Отсев шаблонных отзывов и откликов
- Предварительная проверка учебных работ
- Размеры
- 0,4B (DeBERTa-v3-large)
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
NovaSky (Sky Computing Lab, Беркли) · США
Рассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Компьютерное зрение2023–2025
Google · США
Модели, которые переводят картинки и текст в общее пространство: можно искать фото по словам и классифицировать изображения без обучения. CLIP от OpenAI (2021) — предшественник.
- Поиск картинок по текстовому запросу
- Автоматическая разметка и теги каталога
- Фильтрация недопустимого контента
- Размеры
- около 0.2B – 2B
- Железо
- от: Ноутбук
Роботы2024–2025
Стэнфорд, Беркли и партнёры · США
Первая крупная открытая модель «зрение-язык-действие»: робот-манипулятор выполняет команды вроде «положи яблоко в миску». OFT ускоряет её в разы.
- Управление манипулятором по текстовой команде
- Пилоты по роботизации простых операций
- Основа для дообучения под свой робот
- Размеры
- 7B
- Железо
- от: 1 видеокарта
Синтез речиGGUF2024–2025
hexgrad (независимый разработчик) · не указана
Крошечная модель синтеза речи (82M), которая звучит на уровне крупных. Работает на обычном процессоре; английский и ещё несколько языков, русского нет.
- Озвучка статей и уведомлений
- Голос для приложений без видеокарты
- Массовая озвучка текстов
- Размеры
- 82M
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025
Microsoft Research · США
Модель-агент, которая одинаково планирует действия и в интерфейсе (кнопки на экране), и для робота (движения манипулятора). Пока скорее исследовательская база, чем готовый продукт.
- Пилоты по управлению интерфейсом
- Исследовательские проекты на стыке экрана и робототехники
- Разбор скриншотов с планом действий
- Размеры
- 8B
- Железо
- от: 1 видеокарта
ТекстGGUF2025
HUMAIN (ранее SDAIA) · Саудовская Аравия
Саудовская модель для арабского и английского языков, обученная с нуля. В открытом доступе одна версия на 7B.
- Ассистент на арабском языке
- Ответы на вопросы по документам
- Генерация и редактирование текстов на арабском
- Размеры
- 7B
- Железо
- от: Ноутбук
Поиск и RAGRU2023–2025
Alibaba · Китай
Эмбеддинги и реранкеры Alibaba для поиска: от крошечных до 7B на базе Qwen2. Есть многоязычная версия mGTE с длинным контекстом.
- Смысловой поиск по документам
- Переранжирование результатов поиска
- Кластеризация и классификация текстов
- Размеры
- 33M – 7B
- Железо
- от: Ноутбук
Разбор текстаGGUF2024–2025
Answer.AI и LightOn · США / Франция
Современная замена классическому BERT: быстрее, читает до 8 тысяч токенов за раз. Основа для своих классификаторов. Обучена на английском и коде, для русского есть RuModernBERT.
- Классификация обращений и документов
- Поиск нужных фрагментов в длинных текстах
- Основа для своего классификатора после дообучения
- Размеры
- 150M – 395M
- Железо
- от: Ноутбук
Обработка фото2024–2025
Prama LLC · США
Модель удаления фона с упором на сложные края: волосы, мех, тонкие детали. Открытая версия под MIT, умеет обрабатывать видео.
- Вырезка товара и людей с фото
- Удаление фона на видео
- Подготовка фото для каталога
- Размеры
- около 95M
- Железо
- от: Ноутбук
Компьютерное зрение2022–2025
Сиднейский университет и JD Explore Academy · Австралия / Китай
Простая и точная модель определения позы человека по ключевым точкам. Версия ViTPose++ умеет позы людей, животных и всего тела; встроена в библиотеку Transformers.
- Ключевые точки тела на фото и видео
- Анализ движений в спорте и реабилитации
- Контроль рабочих поз и техники безопасности
- Размеры
- 33M – около 1B
- Железо
- от: Ноутбук
Картинка + текст2023–2025
Alibaba DAMO Academy · Китай
Модели, которые смотрят видео и отвечают на вопросы о нём: что происходит, в какой момент, кто что делает. VideoLLaMA 3 на 2B и 7B — одни из сильнейших в своём размере.
- Описание и краткий пересказ видео
- Поиск момента в записи по вопросу
- Разметка видеоархива
- Размеры
- 2B – 72B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2019–2025
UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия
Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.
- Поиск по базе знаний и FAQ
- Поиск похожих обращений и дублей
- Группировка отзывов и заявок по темам
- Размеры
- около 20M – 470M
- Железо
- от: Ноутбук
Поиск по сканам документов2025
LlamaIndex · США
Небольшая модель для поиска по страницам-картинкам от команды популярного фреймворка RAG. Языки в карточке: английский, итальянский, французский, немецкий, испанский.
- Поиск по сканам и PDF без распознавания текста
- Поиск по счетам, актам и договорам
- Подбор страниц для ответа ИИ-помощника
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
Поиск и RAGRUOllama2024
Snowflake · США
Эмбеддинги от Snowflake, заточенные именно под поиск. Версия 2.0 многоязычная (русский в списке языков), держит длинные тексты до 8 тыс. токенов и умеет сжимать векторы.
- Поиск по документам и базе знаний
- Подбор фрагментов для RAG
- Поиск по отчётам и внутренним данным
- Размеры
- 22M – 568M
- Железо
- от: Ноутбук
Детекция подделок2024
Meta · США
Незаметная метка в синтезированной речи и быстрый детектор, который находит её даже в куске длинной записи. Детектор ошибается в обе стороны: срабатывание — повод для проверки человеком, а не доказательство.
- Пометка речи, синтезированной вашим сервисом
- Поиск своей метки в чужих публикациях
- Проверка, не подмешан ли синтез в запись разговора
- Размеры
- генератор и детектор водяного знака, 16 бит сообщения
- Железо
- от: Ноутбук
Поиск по сканам документов2024
Alibaba (Tongyi Lab) · Китай
Один вектор и для текста, и для картинки, и для их пары: одной моделью можно искать товар по фото, страницу документа по вопросу и картинку по описанию. Языки в карточке: английский и китайский.
- Поиск товара по фотографии
- Поиск по каталогу картинок и карточек
- Поиск по страницам документов как по изображениям
- Размеры
- 2B и 7B
- Железо
- от: 1 видеокарта
Синтез речиGGUF2024
Hugging Face · США
Синтез речи, где голос задаётся текстовым описанием («спокойный женский голос, чистая запись»). Английский и 8 европейских языков, русского нет.
- Подбор голоса по описанию
- Озвучка роликов
- Прототипы голосовых сервисов
- Размеры
- 880M – 2.2B
- Железо
- от: Ноутбук
Документы и OCR2024
StepFun · Китай
Одна из первых универсальных OCR-моделей нового поколения: текст, формулы, таблицы, ноты и схемы. Маленькая, работает на слабом железе, но уже уступает новинкам.
- Распознавание сканов счетов и договоров
- Перевод таблиц в редактируемый вид
- Распознавание формул и схем
- Размеры
- 580M
- Железо
- от: Ноутбук
ПереводRU2024
deepvk (VK) · Россия
Компактные переводчики между казахским и русским от VK. При размере 197M переводят не хуже NLLB на 600M, работают на обычном процессоре.
- Перевод обращений с казахского на русский
- Перевод документов и инструкций на казахский
- Двуязычная поддержка клиентов
- Размеры
- 197M
- Железо
- от: Ноутбук
ВидеоGGUF2024
Genmo · США
Открытая видеомодель на 10B с реалистичным движением. На момент выхода была одной из сильнейших открытых, сейчас обновлений нет.
- Видео по описанию
- Короткие рекламные сцены
- Размеры
- 10B
- Железо
- от: 1 видеокарта
Видео2022–2024
hzwer (Хуан Чжэвэй) и соавторы · Китай
Дорисовывает промежуточные кадры: превращает 24–30 кадров в секунду в 60 и больше и делает плавное замедление. Версии 4.24+ хорошо сглаживают видео от генеративных моделей.
- Повышение частоты кадров видео
- Плавное замедленное видео
- Сглаживание роликов от ИИ-генераторов
- Размеры
- лёгкая модель (размер в карточке не указан)
- Железо
- от: Ноутбук
Кибербезопасность2024
cybersectony · не раскрыта
Очень лёгкий классификатор писем и ссылок на признаки фишинга. Ошибается в обе стороны, поэтому спорные письма всё равно смотрит человек.
- Отметка подозрительных входящих писем
- Проверка ссылок из переписки перед переходом
- Фильтр первого уровня в почтовом шлюзе
- Размеры
- около 66M
- Железо
- от: Ноутбук
Поиск по сканам документов2024
TIGER-Lab · Канада
Превращает модель «картинка плюс текст» в модель эмбеддингов: один вектор для страницы, схемы или фото с подписью. В карточке заявлен английский язык.
- Поиск по смешанному архиву текстов и картинок
- Поиск по страницам документов как по изображениям
- Подбор похожих карточек и иллюстраций
- Размеры
- около 4B (на базе Phi-3.5-V)
- Железо
- от: 1 видеокарта
Поиск по сканам документов2024
LightOn · Франция
Реранкер для страниц-картинок: после визуального поиска переставляет найденные страницы по тому, насколько они отвечают на вопрос. Языки в карточке не указаны.
- Уточнение выдачи поиска по сканам и PDF
- Отбор страниц перед ответом ИИ-помощника
- Сортировка найденных слайдов и отчётов
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
Прогнозы2024
Auton Lab, Университет Карнеги — Меллона · США
Базовая модель для рядов чисел: один движок используют и для прогноза, и для поиска аномалий, и для заполнения пропусков, и для классификации.
- Прогноз спроса и загрузки
- Поиск аномалий в показаниях датчиков и метриках
- Заполнение пропусков в исторических данных
- Размеры
- около 40M – 385M
- Железо
- от: Ноутбук
Прогнозы2024
IBM Research · США
Крошечные модели прогнозов от IBM: считаются на обычном процессоре, их ставят рядом с бизнес-системой без отдельного сервера с видеокартой.
- Прогноз продаж и остатков на складе
- Прогноз энергопотребления и нагрузки оборудования
- Быстрые прогнозы прямо на сервере компании
- Размеры
- очень маленькие: у TinyTimeMixers около 1M параметров
- Железо
- от: Ноутбук
КодOllama2024
01.AI · Китай
Модели для кода от 01.AI на 1.5B и 9B с контекстом 128 тыс. токенов и поддержкой 52 языков программирования. Отдельная линейка рядом с текстовыми Yi.
- Автодополнение и генерация кода
- Объяснение и рефакторинг кода
- Ассистент программиста без облака
- Размеры
- 1.5B – 9B
- Железо
- от: Ноутбук
Поиск по сканам документов2024
Университет Ватерлоо, проект Tevatron · Канада
Ищет по скриншотам страниц: страницу не распознают, а превращают целиком в один вектор — индекс компактнее, чем у моделей с поздним взаимодействием. Языки в карточке: английский и французский.
- Поиск по сканам и PDF без распознавания текста
- Поиск по презентациям и отчётам со сложной вёрсткой
- Подбор страниц для ответа ИИ-помощника
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
Проверка фактов и оценка ответов2024
Flow AI · не раскрыта
Маленькая модель-судья: проверяет ответ по вашей инструкции и ставит оценку с пояснением. Помещается на скромный сервер. Судья сам ошибается и ручную проверку не заменяет.
- Проверка ответов ИИ-помощника на соответствие инструкции
- Массовая оценка выгрузки диалогов
- Контроль качества перед выкаткой изменений
- Размеры
- 3.8B (на базе Phi-3.5-mini)
- Железо
- от: Ноутбук
Прогнозы2024
Команда Time-MoE · не раскрыта
Модель прогнозов с разреженной архитектурой: на каждом шаге работает лишь часть сети, поэтому она остаётся быстрой при небольшом размере.
- Прогноз продаж и остатков
- Прогноз нагрузки на сервисы и персонал
- Планирование закупок по истории
- Размеры
- 50M и 200M
- Железо
- от: Ноутбук
Картинка + текстНе развивается2023–2024
Hugging Face · Франция / США
Открытые модели зрения от Hugging Face, воспроизводившие закрытую Flamingo. Idefics3 стала основой для компактной линейки SmolVLM.
- Ответы на вопросы по картинкам
- Разбор документов и скриншотов
- Основа для дообучения
- Размеры
- 8B – 80B
- Железо
- от: 1 видеокарта
Документы и OCRНе развивается2024
Microsoft · США
Превращает скан страницы в размеченный текст с координатами блоков или в markdown. Удобна как первый шаг перед разбором резюме. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Перевод сканов резюме в текст с сохранением структуры
- Подготовка документов к извлечению полей
- Оцифровка бумажных анкет
- Размеры
- около 1.4B
- Железо
- от: 1 видеокарта
КартинкиНе развивается2023–2024
Лвминь Чжан (Стэнфорд) и сообщество · США
Надстройка над моделями картинок: задаёт позу, контуры, глубину или планировку, чтобы результат точно повторял нужную композицию.
- Картинка по эскизу или контуру
- Сохранение позы и композиции
- Визуализация интерьеров по планировке
- Размеры
- 0.4B – 1.3B
- Железо
- от: Ноутбук
ВидеоНе развивается2023–2024
Shanghai AI Lab и CUHK · Китай
Модуль, который оживляет модели картинок Stable Diffusion и превращает их в короткую анимацию. Одна из первых открытых видеотехнологий.
- Короткие анимации в фирменном стиле
- Живые обложки и баннеры
- Анимированные стикеры
- Размеры
- модуль движения поверх SD 1.5 / SDXL
- Железо
- от: Ноутбук
АватарыНе развивается2024
Kuaishou (Kling) · Китай
Оживляет портрет по видео-образцу: мимика и повороты головы переносятся с актёра на фото. Быстро работает даже на слабой видеокарте.
- Оживление портретов
- Перенос мимики актёра на персонажа
- Анимация маскотов
- Размеры
- меньше 1B
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2020–2024
SberDevices (ai-forever) · Россия
Русскоязычные энкодеры Сбера, обученные на больших русских корпусах. Основа для классификаторов, NER и поиска по смыслу на русском.
- Классификация обращений на русском
- Извлечение имён, сумм и дат после дообучения
- Определение тональности отзывов
- Размеры
- около 30M – 430M
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовНе развивается2023–2024
Vectara · США
Маленькая модель, которая проверяет, опирается ли ответ ИИ на исходный текст или выдуман. Работает на процессоре, удобна как фильтр в RAG-системах.
- Проверка ответов чат-бота по базе знаний на выдумки
- Контроль качества пересказов документов
- Сравнение языковых моделей по склонности к ошибкам
- Размеры
- 110M
- Железо
- от: Ноутбук
РеранкерыGGUFНе развивается2023–2024
BAAI (Пекинская академия ИИ) · Китай
Реранкеры: берут найденные поиском фрагменты и переставляют их по реальной близости к вопросу. Версия v2-m3 многоязычная и лёгкая, её часто ставят в пару к bge-m3.
- Уточнение выдачи перед ответом чат-бота
- Сортировка результатов поиска по базе знаний
- Отбор самых подходящих пунктов договоров и регламентов
- Размеры
- 278M – 9B
- Железо
- от: Ноутбук
Модерация и безопасностьGGUFНе развивается2024
Ai2 (Allen Institute for AI) · США
Открытый фильтр Ai2: одним проходом определяет, опасен ли запрос, опасен ли ответ и не отказал ли бот зря. Работает на английском.
- Проверка запросов к боту
- Проверка ответов бота
- Поиск лишних отказов бота на безобидные вопросы
- Размеры
- 7B
- Железо
- от: 1 видеокарта
Картинка + текстНе развивается2024
Microsoft · США
Очень маленькая модель зрения: подписи, поиск объектов, сегментация и чтение текста по одной команде. Работает даже на процессоре.
- Чтение текста на фото
- Поиск и выделение объектов
- Автоматические подписи к фото
- Размеры
- 0.23B – 0.77B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
01.AI · Китай
Двуязычные (английский и китайский) модели 01.AI на 6–34B с версиями на контекст до 200 тыс. токенов. Новых открытых выпусков с 2024 года нет.
- Чат-ассистент на одной видеокарте
- Разбор длинных документов
- Классификация и извлечение данных из текста
- Размеры
- 6B – 34B
- Железо
- от: Ноутбук
Обработка фотоНе развивается2023–2024
Shanghai AI Laboratory (OpenMMLab) и Университет Цинхуа · Китай
Универсальная дорисовка фото: убрать объект, вставить новый по описанию, заменить форму или расширить кадр за края.
- Удаление и замена объектов на фото
- Расширение кадра под нужный формат
- Вставка товара или детали по текстовому описанию
- Размеры
- на базе SD 1.5
- Железо
- от: Ноутбук
Обработка фотоНе развивается2024
Лвмин Чжан (автор ControlNet) · США
Меняет освещение на фото: ставит объект или человека в новый свет по описанию или под заданный фон, чтобы вырезка смотрелась естественно.
- Подгонка света товара под новый фон
- Студийный свет для портретов без пересъёмки
- Единый стиль освещения в каталоге
- Размеры
- на базе SD 1.5
- Железо
- от: Ноутбук
ТекстНе развивается2024
Equall · Франция
Языковые модели для юридических текстов, дообученные на базах права США и Европы (основа Mistral и Mixtral). Только английский.
- Разбор договоров на английском
- Поиск рисков и нестандартных условий
- Черновики юридических справок
- Размеры
- 7B – 141B
- Железо
- от: Ноутбук
Детекция подделокНе развивается2024
UC Santa Barbara и соавторы · США
Детектор ИИ-текста на Longformer: держит длинный документ целиком и обучен на текстах от множества разных языковых моделей. Ошибается в обе стороны, его вывод — повод для проверки человеком.
- Проверка длинных статей и отчётов целиком
- Отсев машинного текста в потоке публикаций
- Сравнение детекторов на своих данных
- Размеры
- около 150M (Longformer-base)
- Железо
- от: Ноутбук
КартинкиНе развивается2023–2024
Huawei Noah's Ark Lab и партнёры · Китай
Компактная модель картинок на 0.6B с качеством уровня крупных. Умеет 4K в версии Sigma, подходит для скромного железа.
- Иллюстрации для статей и соцсетей
- Фоны для карточек товаров
- Быстрые черновики визуалов
- Размеры
- 0.6B
- Железо
- от: Ноутбук
МедицинаGGUFНе развивается2024
Авиньонский университет и Нантский университет · Франция
Mistral 7B, дообученная на статьях PubMed Central, плюс несколько слияний с общей моделью. Компактная и простая в запуске. Не заменяет врача, решения принимает специалист.
- Поиск и пересказ медицинских статей
- Черновики справочных материалов для персонала
- Разбор медицинской терминологии
- Размеры
- 7B
- Железо
- от: Ноутбук
3DНе развивается2024
Tencent ARC · Китай
Делает 3D-сетку по одной картинке примерно за 10 секунд: сначала рисует объект с нескольких ракурсов, потом собирает из них модель.
- 3D-модель объекта по фото
- Заготовки для игр и визуализаций
- Прототипы для 3D-печати
- Размеры
- н/д
- Железо
- от: 1 видеокарта
ТекстOllamaНе развивается2023–2024
Hugging Face (H4) · США
Учебные чат-модели Hugging Face на базе Mistral, Gemma и Mixtral с открытым рецептом дообучения. Zephyr 7B Beta показал, что маленькую модель можно «воспитать» до уровня крупных без ручной разметки людьми.
- Лёгкий чат-ассистент
- Образец и отправная точка для своего дообучения
- Черновики текстов и ответов
- Размеры
- 7B – 141B-A35B
- Железо
- от: Ноутбук
Голос: спикеры и звукНе развивается2024
MyShell и MIT · США
Мгновенное клонирование голоса по короткому образцу с управлением эмоцией и акцентом, V2 говорит на нескольких языках. Использовать только с согласия владельца голоса.
- Озвучка роликов голосом диктора компании
- Голосовой бот с узнаваемым голосом бренда
- Перенос тембра на готовый синтез речи
- Размеры
- менее 1B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовНе развивается2023–2024
KAIST и LG AI Research (prometheus-eval) · Южная Корея
Открытая модель-судья: оценивает ответы других моделей по вашим критериям и объясняет оценку. Замена платным моделям в роли проверяющего.
- Оценка ответов чат-бота по своей шкале
- Сравнение двух вариантов ответа
- Проверка качества перед запуском ИИ-сервиса
- Размеры
- 7B – 8x7B
- Железо
- от: Ноутбук
Синтез речиНе развивается2024
MyShell и MIT · США
Лёгкий многоязычный синтез речи, который успевает в реальном времени на обычном процессоре. Английский с акцентами, испанский, французский, китайский, японский и корейский; русского нет.
- Озвучка ответов ботов на иностранных языках
- Озвучка обучающих материалов
- Чтение текстов вслух на сервере без видеокарты
- Размеры
- небольшая, работает в реальном времени на процессоре
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2024
Chat2DB · Китай
Модель текст-в-SQL из открытого инструмента работы с базами Chat2DB: поддерживает разные диалекты SQL, карточка на английском и китайском.
- Перевод вопроса в SQL внутри клиента базы данных
- Черновики запросов под разные СУБД
- Подсказки разработчику при работе со схемой
- Размеры
- 7B
- Железо
- от: Ноутбук
Разбор текстаНе развивается2024
University of Southern Denmark · Дания
Переводит свободное описание профессии в стандартный код HISCO на 13 языках. Создана для исторических архивов, но годится и для наведения порядка в справочниках должностей. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Приведение разнородных названий профессий к единому коду
- Разбор архивов кадровых и статистических данных
- Подготовка данных для отчётности
- Размеры
- на базе CANINE-s, размер на карточке не указан
- Железо
- от: Ноутбук
ТекстRUНе развивается2023–2024
Сбер (ai-forever) · Россия
Русская модель «текст в текст» от Сбера, наследница ruT5 (2021). Небольшая и быстрая: её дообучают на пересказ, перефразирование и исправление ошибок в русском тексте, есть готовые версии проверки орфографии SAGE.
- Исправление орфографии и опечаток в русском тексте
- Краткий пересказ и перефразирование
- Нормализация заявок и обращений перед обработкой
- Размеры
- 95M – 1.7B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
TinyLlama (исследователи SUTD) · Сингапур
Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.
- Простые чат-боты на слабом железе
- Эксперименты и обучение команды
- Основа для дообучения под узкую задачу
- Размеры
- 1.1B
- Железо
- от: Ноутбук
КибербезопасностьGGUFНе развивается2023–2024
ZySec AI · Индия
Небольшой открытый помощник для специалистов по безопасности: вопросы по стандартам, разбор угроз и уязвимостей, подготовка внутренних документов.
- Ответы на вопросы по политикам и стандартам безопасности
- Первичный разбор сообщений об угрозах
- Черновики внутренних инструкций по защите
- Размеры
- 2.8B и 7B
- Железо
- от: Ноутбук
Детекция подделокНе развивается2023–2024
Sichuan University и соавторы · Китай
Открытая модель поиска подделок в изображениях: выдаёт попиксельную маску изменённых участков. Ошибается в обе стороны, её карта — подсказка эксперту, а не доказательство подделки.
- Поиск вклеенных и затёртых фрагментов на фото
- Проверка сканов документов на правку
- Базовая линия при сравнении моделей поиска монтажа
- Размеры
- модель на базе Vision Transformer
- Железо
- от: 1 видеокарта
Поиск и RAGRUНе развивается2022–2024
Microsoft · США
Проверенные модели для смыслового поиска. Многоязычные версии хорошо работают с русским и до сих пор служат надёжной основой для RAG.
- Поиск по базе знаний и документам
- Подбор ответов для чат-бота (RAG)
- Поиск похожих обращений и дублей
- Размеры
- 33M – 7B
- Железо
- от: Ноутбук
ПрогнозыНе развивается2024
ServiceNow, Mila и партнёры · Канада
Одна из первых открытых моделей прогнозов «из коробки». Крошечная, даёт вероятностный прогноз, сейчас уступает Chronos и TimesFM.
- Вероятностный прогноз продаж
- Быстрые пилоты прогнозирования
- Базовая модель для сравнения
- Размеры
- 2.4M
- Железо
- от: Ноутбук
Документы и OCRНе развивается2024
Microsoft · США
Одна модель на все задачи с документом: чтение, ответы на вопросы по странице, извлечение полей, классификация. В HR применяется для разбора резюме и приложенных сканов. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Извлечение полей из резюме и приложений к нему
- Ответы на вопросы по содержимому документа
- Классификация входящих документов
- Размеры
- 742M
- Железо
- от: Ноутбук
Поиск и RAGRUOllamaНе развивается2024
BAAI · Китай
Модель для поиска по смыслу на сотне языков. Основа RAG: бот находит нужный кусок документа перед ответом.
- Поиск по базе документов
- RAG для чат-бота
- Поиск похожих обращений и дублей
- Размеры
- 568M
- Железо
- от: Ноутбук
Спутниковые снимки и геоНе развивается2023–2024
Allen Institute for AI (Ai2) · США
Предобученные модели проекта Satlas для снимков Sentinel-2, Landsat и аэрофото высокого разрешения. Предшественник OlmoEarth, до сих пор используется в TorchGeo.
- Поиск объектов на снимках: солнечные станции, ветряки, суда
- Разметка дорог и застройки по аэрофото
- Стартовая точка для дообучения своей геомодели
- Размеры
- Swin-v2 и ResNet бэкбоны (Base)
- Железо
- от: Ноутбук
Обработка фотоНе развивается2023
Alibaba DAMO Academy · Китай
Окрашивание чёрно-белых фото в естественные цвета. Лёгкая модель с коммерческой лицензией, есть компактная версия tiny.
- Окрашивание архивных фото
- Цветные версии исторических снимков для публикаций
- Сервис оживления семейных фото
- Размеры
- DDColor-T (tiny) и DDColor-L
- Железо
- от: Ноутбук
Голос: спикеры и звукНе развивается2023
Resemble AI · США
Модель улучшения речи: убирает шум и дорисовывает потерянные частоты, так что глухая запись звучит как студийная. Хороша для подготовки голоса к озвучке.
- Реставрация старых и телефонных записей
- Очистка голоса перед озвучкой и клонированием
- Улучшение звука в роликах и подкастах
- Размеры
- менее 1B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
Intel · США
Дообученная Mistral 7B от Intel, показывавшая обучение и запуск на процессорах и ускорителях Intel. Устарела, интересна как пример оптимизации под железо Intel.
- Простой чат-ассистент
- Эксперименты с запуском на железе Intel
- Основа для дообучения
- Размеры
- 7B
- Железо
- от: Ноутбук
РеранкерыНе развивается2023
NetEase Youdao · Китай
Пара «эмбеддинг плюс реранкер» для баз знаний. В карточке заявлены английский, китайский, японский и корейский — русского в списке языков нет.
- Поиск по базе знаний и справочным материалам
- Переупорядочивание найденных фрагментов
- Подбор ответов для чат-бота поддержки
- Размеры
- около 280M
- Железо
- от: Ноутбук
ПереводRUGGUFНе развивается2023
Google · США
Переводчик Google более чем на 400 языков под свободной лицензией. Русский есть. Хорошая замена NLLB, когда нужна коммерция.
- Перевод документов и писем
- Перевод каталогов и описаний товаров
- Перевод на языки стран СНГ и Азии
- Размеры
- 3B – 10B
- Железо
- от: Ноутбук
Документы и OCRНе развивается2022–2023
Microsoft · США
Небольшие модели, которые находят таблицы на страницах PDF и сканов и восстанавливают их структуру: строки, столбцы, заголовки. Текст внутри читает отдельный OCR.
- Поиск таблиц в отчётах, выписках и счетах
- Восстановление строк и столбцов для выгрузки в Excel
- Подготовка табличных данных для анализа и RAG
- Размеры
- 29M
- Железо
- от: Ноутбук
Музыка и звукНе развивается2023
LAION · Германия
Аналог CLIP для звука: переводит аудио и текст в общее пространство. Можно искать звуки и музыку по описанию и классифицировать их без обучения. Текст — английский.
- Поиск звуков и музыки по описанию
- Автоматические теги для аудиотеки
- Распознавание типа звука (сирена, стекло, голос)
- Размеры
- размер на карточке не указан
- Железо
- от: Ноутбук
Текст в SQLНе развивается2023
RUCKBReasoning, Китайский народный университет · Китай
Ранняя линейка открытых моделей текст-в-SQL размером от 1B: есть варианты, дообученные под конкретные схемы баз данных.
- Перевод вопроса сотрудника в SQL-запрос
- Черновики запросов к хранилищу под отчёт
- Встраивание в BI-панель как подсказчик
- Размеры
- 1B – 15B
- Железо
- от: Ноутбук
Обработка фотоНе развивается2022–2023
Ким Тэхун (POSTECH) · Южная Корея
Модель выделения главного объекта и готовая программа transparent-background на её основе: убирает фон с фото, видео и веб-камеры одной командой.
- Пакетное удаление фона с фото
- Замена фона на цвет или размытие
- Удаление фона на видео
- Размеры
- небольшая (на базе Swin-B)
- Железо
- от: Ноутбук
Детекция подделокНе развивается2022–2023
EURECOM · Франция
Развитие AASIST: вместо сырого звука берётся речевой энкодер wav2vec 2.0, из-за чего модель лучше держится на незнакомых способах синтеза. Ошибается в обе стороны — итог проверяет человек.
- Обнаружение синтезированной речи в звонках
- Проверка голосовых сообщений и записей
- Дообучение под свои данные и кодеки
- Размеры
- около 0,3B (энкодер wav2vec 2.0 XLS-R)
- Железо
- от: Ноутбук
ТекстRUGGUFНе развивается2022–2023
Сбер (ai-forever) · Россия
Многоязычная модель Сбера на 61 язык, включая языки народов России и СНГ. Есть отдельные доучки под бурятский, якутский, татарский, башкирский, казахский и другие языки — редкость для открытых моделей.
- Тексты на языках народов России и СНГ
- Основа для дообучения под редкий язык
- Черновики и шаблоны на нескольких языках
- Размеры
- 1.3B – 13B
- Железо
- от: Ноутбук
Обработка фотоНе развивается2022–2023
XPixel Group (Шэньчжэньский институт передовых технологий АН Китая и др.) · Китай
Увеличение фото на трансформере, точнее SwinIR на тонких деталях. Есть версии для реальных снимков с шумом и лёгкая HAT-S.
- Увеличение фото товаров и интерьеров
- Подготовка изображений к печати
- Повышение чёткости архивных снимков
- Размеры
- 9M – 40M
- Железо
- от: Ноутбук
Голос: спикеры и звукНе развивается2022–2023
Хендрик Шретер (Университет Эрлангена) · Германия
Лёгкое шумоподавление речи в реальном времени: работает даже на обычном процессоре и на слабых устройствах. Убирает гул, улицу, шум офиса, оставляя голос.
- Очистка звонков и голосовых сообщений от шума
- Подготовка записей перед распознаванием речи
- Шумодав для видеосвязи
- Размеры
- около 2M
- Железо
- от: Ноутбук
АватарыНе развивается2023
Сианьский университет Цзяотун и Tencent AI Lab · Китай
Старая лёгкая модель говорящей головы: одно фото и аудио превращаются в видео. Работает на слабом железе, но качество заметно ниже новых.
- Говорящее фото для приветствия
- Простые озвученные аватары
- Размеры
- меньше 1B
- Железо
- от: Ноутбук
ТекстRUGGUFНе развивается2023
Сбер (ai-forever) · Россия
Базовая русскоязычная модель Сбера на 13 млрд параметров, из дообученной версии которой вырос GigaChat. Продолжает тексты на русском и английском, контекст всего 2048 токенов; сегодня интересна как основа для узкого дообучения.
- Основа для дообучения под узкую русскую задачу
- Генерация шаблонных русских текстов
- Эксперименты с русскоязычными моделями без ограничений лицензии
- Размеры
- 13B
- Железо
- от: 1 видеокарта
Синтез речиRUGGUFНе развивается2023
Suno · США
Одна из первых открытых моделей, которая озвучивает текст с интонациями, смехом и паузами. Поддерживает около десятка языков, включая русский. Сейчас устарела.
- Черновая озвучка роликов
- Прототипы голосовых сервисов
- Звуковые эффекты в речи
- Размеры
- около 300M – 1B
- Железо
- от: Ноутбук
3DНе развивается2022–2023
OpenAI · США
Ранние открытые модели OpenAI, которые делают 3D-объект по тексту или картинке за секунды. Качество простое, зато быстро и легко запускается.
- Черновые 3D-макеты по описанию
- Быстрые прототипы объектов для игр и AR
- Учебные и исследовательские пилоты по 3D
- Размеры
- 40M – 1B
- Железо
- от: Ноутбук
ТекстНе развивается2022–2023
Google · США
Компактные модели «вход-выход», обученные выполнять инструкции. До сих пор используются как дешёвая основа для классификации, извлечения и коротких ответов.
- Классификация обращений и документов
- Извлечение полей из текста
- Короткие ответы и пересказ
- Размеры
- 80M – 20B
- Железо
- от: Ноутбук
Картинка + текстНе развивается2023
Google · США
Читает документ или скриншот как картинку и отвечает структурой: текст, поля, ответы на вопросы. В HR её дообучают под резюме и анкеты. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Извлечение данных из резюме и анкет в виде картинок
- Вопросы к содержимому скана
- Разбор таблиц и схем в документах
- Размеры
- 282M – 1.3B
- Железо
- от: Ноутбук
ТекстНе развивается2022–2023
EleutherAI · США
Полностью открытые модели некоммерческой лаборатории EleutherAI: GPT-NeoX-20B и серия Pythia с опубликованными промежуточными снимками обучения.
- Базовая модель для дообучения
- Исследование поведения моделей
- Простая генерация и дополнение текста
- Размеры
- 70M – 20B
- Железо
- от: Ноутбук
Музыка и звукНе развивается2022
MIT · США
Классическая модель 2021 года для распознавания звуков: определяет 527 классов событий AudioSet (сирена, лай, стекло, музыка). Лёгкая, работает без видеокарты, с 2022 года в Transformers.
- Распознавание звуковых событий
- Разметка аудиоархива
- Детекция тревожных звуков
- Размеры
- около 87M
- Железо
- от: Ноутбук
Документы и OCRНе развивается2022
SCUT DLVC Lab, Южно-Китайский технологический университет · Китай
Лёгкая модель, которая учитывает и текст, и расположение блоков на странице: обучается на одном языке и переносится на другие. Подходит для разметки полей резюме и анкет. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Разметка полей в резюме и анкетах
- Извлечение данных из форм и бланков
- Разбор документов на нескольких языках
- Размеры
- около 130M английская и около 280M многоязычная версия
- Железо
- от: Ноутбук
Документы и OCRНе развивается2021–2022
Microsoft · США
Распознаёт одну строку текста, в том числе рукописного. Официальные веса только для английского, но модель часто дообучают под другие языки — есть русские версии от сообщества.
- Распознавание рукописных строк в анкетах и бланках
- Распознавание печатных строк после поиска текста на странице
- Основа для дообучения под свой почерк или шрифт
- Размеры
- 62M – 608M
- Железо
- от: Ноутбук
Документы и OCRНе развивается2022
NAVER CLOVA · Южная Корея
Читает скан документа и сразу отдаёт заполненную структуру полей, без отдельного OCR. В HR её дообучают под разбор резюме и анкет. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Извлечение полей из анкет и резюме
- Разбор сканов справок и дипломов
- Определение типа входящего документа
- Размеры
- около 200M
- Железо
- от: Ноутбук
РеранкерыRUНе развивается2022
UKP Lab и сообщество Sentence Transformers · Германия
Самые скачиваемые открытые реранкеры: крошечная модель читает пару «вопрос — найденный фрагмент» и ставит оценку близости. Многоязычная версия mMARCO знает русский.
- Переупорядочивание результатов поиска по базе знаний
- Отбор фрагментов перед ответом чат-бота
- Поиск дублей среди обращений и карточек товаров
- Размеры
- около 4M – 120M
- Железо
- от: Ноутбук
Обработка фотоGGUFНе развивается2021–2022
Tencent ARC Lab · Китай
Классика увеличения фото в 2–4 раза с очисткой от шума и артефактов сжатия. Лёгкая, работает даже на процессоре. Есть версии для рисунков и аниме.
- Увеличение старых и мелких фото товаров
- Очистка картинок от артефактов сжатия
- Подготовка изображений к печати
- Размеры
- около 17M
- Железо
- от: Ноутбук
Компьютерное зрениеНе развивается2021–2022
OpenAI · США
Модель 2021 года, которая первой связала картинки и текст: поиск фото по словам и классификация без обучения. Понимает только английский, сейчас чаще берут SigLIP 2 или PE.
- Поиск картинок по текстовому запросу
- Автоматические теги для каталога
- Поиск похожих изображений
- Размеры
- около 0.15B – 0.6B
- Железо
- от: Ноутбук
Обработка фотоНе развивается2021–2022
Tencent ARC Lab · Китай
Проверенная реставрация лиц на старых и сжатых фото с коммерческой лицензией. Часто работает в паре с Real-ESRGAN, самые ходовые версии 1.3 и 1.4.
- Восстановление лиц на старых фото
- Улучшение аватаров и фото профиля
- Реставрация в фотосалоне или онлайн-сервисе
- Размеры
- небольшая, до 0.1B
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2019–2022
Meta · США
Классический многоязычный энкодер на 100 языков, включая русский. Основа многих моделей тональности, NER и эмбеддингов, в том числе BGE-M3.
- Определение тональности отзывов на разных языках
- Извлечение имён и организаций после дообучения
- Классификация обращений
- Размеры
- 270M – 10.7B
- Железо
- от: Ноутбук
Компьютерное зрениеRUНе развивается2022
Сбер AI и SberDevices (ai-forever) · Россия
Русская версия CLIP: сопоставляет картинки и подписи на русском. Позволяет искать фото по описанию и раскладывать изображения по категориям без обучения.
- Поиск товаров по фото и по русскому описанию
- Сортировка картинок по категориям без разметки
- Проверка соответствия фото и подписи
- Размеры
- 150M – 430M
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2021
Microsoft · США
Проверенный временем энкодер, на котором построено множество классификаторов и NER-моделей (в том числе GLiNER). Многоязычная mDeBERTa-v3 понимает русский.
- Классификация отзывов по тональности
- Извлечение сущностей после дообучения
- Проверка, следует ли вывод из текста
- Размеры
- 70M – 435M
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2021
Давид Дале (cointegrated) · Россия
Очень маленький русско-английский BERT, работает быстро на обычном процессоре. Есть готовые дообученные версии для тональности, токсичности и эмоций.
- Определение тональности отзывов
- Фильтр грубых сообщений в чате
- Быстрая классификация обращений
- Размеры
- 12M – 29M
- Железо
- от: Ноутбук
Детекция подделокНе развивается2021
NAVER Clova AI Research и EURECOM · Южная Корея
Базовая открытая модель против подмены голоса: слушает сырую запись и отличает живого человека от синтеза и записи. Ошибается в обе стороны — её вывод повод для проверки человеком, а не доказательство.
- Проверка голоса при телефонной аутентификации
- Отсев записей и синтеза в голосовом меню
- Базовая линия при сравнении детекторов голоса
- Размеры
- файлы весов 0,4 и 1,3 МБ
- Железо
- от: Ноутбук
Обработка фотоGGUFНе развивается2021
Samsung AI Center Москва (вместе со Сколтехом) · Россия
Удаление лишних объектов, надписей и водяных знаков с фото с аккуратной дорисовкой фона. Лёгкая и быстрая, до сих пор стандарт для такой задачи.
- Удаление ценников, людей и мусора с фото
- Чистка фото интерьеров и недвижимости
- Удаление надписей и дат с архивных снимков
- Размеры
- около 51M
- Железо
- от: Ноутбук
Обработка фотоНе развивается2021
ETH Zurich · Швейцария
Модель на трансформере для увеличения, шумоподавления и очистки фото от артефактов JPEG. Лёгкая и проверенная, часто стоит внутри других систем.
- Увеличение фото
- Шумоподавление снимков
- Очистка от артефактов сжатия
- Размеры
- около 12M
- Железо
- от: Ноутбук
ПереводRUGGUFНе развивается2020–2021
Meta · США
Ранний переводчик Meta, который переводит напрямую между 100 языками, без английского посередине. Русский есть. Старый, но лёгкий и свободный.
- Перевод между любой парой из 100 языков
- Быстрый черновой перевод на слабом железе
- Основа для дообучения под свою тематику
- Размеры
- 418M – 12B
- Железо
- от: Ноутбук
ФинансыНе развивается2020
Prosus · Нидерланды
Классическая модель, которая определяет тон финансовых новостей: позитив, негатив или нейтрально. Только английский, быстро работает на процессоре.
- Оценка тона новостей о компаниях
- Разметка отчётов и пресс-релизов
- Сигналы для аналитических дашбордов
- Размеры
- 110M
- Железо
- от: Ноутбук
Детекция подделокНе развивается2020
MiniVision Technology · Китай
Практически единственный полностью открытый набор весов для проверки живого лица по одному кадру: отличает человека от фото, экрана или маски. Ошибается в обе стороны — отказ должен уметь оспорить человек.
- Проверка живого лица при входе по селфи
- Защита пропускной системы от фото на телефоне
- Проверка при удалённой идентификации клиента
- Размеры
- две модели примерно по 1,8 МБ
- Железо
- от: Ноутбук