ТекстOllama2023–2026
DeepSeek · Китай
Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.
- Ассистент для сотрудников на своём сервере
- Разбор длинных договоров и отчётов
- Агенты, которые работают с инструментами и API
- Размеры
- 7B – 1.6T-A49B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Shanghai AI Laboratory · Китай
Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.
- Помощник исследователя: статьи, формулы, данные
- Разбор научных и технических документов
- Корпоративный чат на малых моделях
- Размеры
- 1.8B – около 1T
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Xiaomi · Китай
Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.
- Логические и расчётные задачи
- Агенты с инструментами
- Помощь программистам
- Размеры
- 7B – 1,02T-A42B
- Железо
- от: Ноутбук
Текст2024–2026
OpenBMB (ModelBest и Университет Цинхуа) · Китай
Компактные текстовые модели для работы прямо на устройстве: ноутбуке, телефоне, мини-ПК. MiniCPM5 на 1B и 2B ориентированы на вызов инструментов и длинный контекст.
- Локальный чат-ассистент без облака
- Извлечение данных и классификация текстов
- Вызов инструментов и простые агенты на слабом железе
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
Текст2024–2026
MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ
Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.
- Рассуждения, математика и технические вопросы
- Разбор длинных документов
- Агенты и написание кода
- Размеры
- 0.9B – 375B-A23B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Жэньминьский университет (GSAI) и Ant Group (inclusionAI) · Китай
Диффузионные языковые модели: текст пишется не по одному слову, а сразу блоками с последующим уточнением, что ускоряет генерацию. LLaDA2.2 умеет править уже написанное и рассчитана на агентов. Генератор картинок LLaDA-Image — отдельный продукт.
- Быстрая генерация кода и текстов
- Агентные сценарии с длинным контекстом
- Исследования альтернатив обычным LLM
- Размеры
- 8B – 100B (MoE)
- Железо
- от: 1 видеокарта
ТекстRU2026
SberDevices (ai-forever) · Россия
Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.
- Эксперименты с ускорением генерации
- Дообучение небольших моделей под свои задачи
- Исследования
- Размеры
- 0.6B – 4B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Alibaba · Китай
Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.
- Чат-бот и ассистент по базе знаний
- Ответы на письма и обращения
- Разбор и классификация документов
- Размеры
- 0,6B – 2,4T-A95B
- Железо
- от: Ноутбук
Поиск и RAGRU2024–2026
Сбер (SberDevices) · Россия
Эмбеддинги Сбера, заточенные под русский язык: по данным разработчиков, в числе лучших на русскоязычных тестах поиска. FRIDA компактная, Giga-Embeddings мощнее.
- Поиск по русскоязычным документам
- RAG для чат-ботов на русском
- Классификация обращений и отзывов
- Размеры
- 480M – 10B-A1.8B
- Железо
- от: Ноутбук
Речь в текстGGUF2024–2026
Moonshine AI (Useful Sensors) · США
Очень маленькие и быстрые модели распознавания речи для телефонов, планшетов и встраиваемых устройств. Вторая версия работает потоково и выдаёт текст, пока человек ещё говорит.
- Голосовое управление устройствами
- Распознавание на телефоне без интернета
- Живые субтитры
- Размеры
- 27M – 245M
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Zhipu AI (Z.ai) · Китай
Одна из старейших китайских открытых линий: от ChatGLM-6B до GLM-5.3. Сильна в агентных задачах и программировании; GLM-5.3-Flash понимает картинки и выходит под MIT.
- Корпоративный чат-ассистент
- Агенты для рутинных офисных задач
- Помощь программистам
- Размеры
- 1.5B – 744B-A40B
- Железо
- от: Ноутбук
Текст2024–2026
Tencent · Китай
Языковые модели Tencent: от малых 0.5B–7B до Hy4-preview на 770 млрд параметров. С 2026 года линия переименована в Hy, а новые версии вышли под Apache 2.0.
- Корпоративный ассистент
- Перевод и работа с многоязычными текстами
- Агенты с инструментами
- Размеры
- 0.5B – 770B-A49B
- Железо
- от: Ноутбук
Текст2025–2026
Ant Group (inclusionAI) · Китай
Семейство Ant Group: Ling — обычные модели, Ring — рассуждающие. Есть и триллионные флагманы, и экономичная Ling-3.0-tiny, которой хватает 1,3 млрд активных параметров.
- Корпоративный ассистент
- Агенты для офисных процессов
- Финансовая аналитика (есть версия Fin)
- Размеры
- 7.9B-A1.3B – 1T
- Железо
- от: Ноутбук
ТекстOllama2024–2026
NVIDIA · США
Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).
- Агенты с вызовом инструментов
- Задачи с рассуждением и расчётами
- Ответы по длинным документам
- Размеры
- 4B – 550B-A55B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
IBM · США
Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.
- Ответы по внутренним документам (RAG)
- Вызов инструментов и работа в агентах
- Извлечение данных и классификация
- Размеры
- 350M – 34B
- Железо
- от: Ноутбук
ТекстOllama2026
Meta Superintelligence Labs · США
Открытая модель Meta для агентов на доступном железе: дистиллирована из закрытой Muse Spark, понимает текст и картинки, обучена на 100+ языках.
- Агенты с вызовом инструментов
- Разбор скриншотов, графиков и документов
- Многоязычный ассистент
- Размеры
- 30B
- Железо
- от: 1 видеокарта
Разбор текста2024–2026
Урчаде Заратиана и Fastino AI · Франция / США
Находит в тексте нужные сущности без обучения: просто перечисляете, что искать (имя, сумма, дата). GLiNER2 заодно классифицирует текст. Многоязычные версии понимают русский.
- Извлечение имён, сумм и дат из писем и договоров
- Разбор заявок на поля CRM
- Классификация обращений по темам
- Размеры
- около 50M – 500M
- Железо
- от: Ноутбук
Агенты для компьютера2025–2026
XLANG Lab (Гонконгский университет) · Китай
Полностью открытые агенты для рабочего стола: веса, данные и код обучения. Работают в Windows, macOS и Linux, свежий Qwen-CUA управляет компьютером обычными кликами и клавишами.
- Работа в настольных программах без API
- Перенос данных между системами
- Прогон пользовательских сценариев для тестов
- Размеры
- 7B – около 400B (MoE)
- Железо
- от: 1 видеокарта
Агенты для компьютераGGUF2025–2026
Ant Group (inclusionAI) · Китай
Семейство Ant Group для поиска элементов на экране и выполнения задач в интерфейсе телефона и компьютера. UI-Venus-2 отдельно обучали отказываться от опасных действий.
- Автоматизация действий в мобильных приложениях
- Заполнение форм в веб-интерфейсах
- Автотесты интерфейсов
- Размеры
- 2B – 72B
- Железо
- от: Ноутбук
КодOllama2026
DeepReinforce · не раскрыта
Модели для агентной разработки: сами строят план и обвязку под задачу и выполняют её в терминале. Дообучены на базе Qwen 3.5 и Gemma 4, работают с Claude Code, OpenHands и похожими инструментами.
- Агент-разработчик в терминале
- Исправление ошибок по описанию задачи
- Разбор и доработка большого репозитория
- Размеры
- 9B – 397B
- Железо
- от: 1 видеокарта
ТекстRUOllama2023–2026
Mistral AI · Франция
Европейские модели с упором на скорость. Mixtral — одна из первых открытых моделей на архитектуре «смесь экспертов»; есть версии с картинками (Pixtral, Medium 3.5), для доказательств в Lean и модерации (Shieldstral).
- Быстрые ответы в чате
- Извлечение данных из текста
- Перевод и работа с несколькими языками
- Размеры
- 3B – 675B
- Железо
- от: Ноутбук
Код2025–2026
Kwaipilot (Kuaishou) · Китай
Модели Kuaishou для агентной разработки, обученные решать реальные задачи в репозиториях. KAT-Coder-V2.5-Dev (35B, активны 3B) — открытая версия их закрытого флагмана.
- Агент, исправляющий задачи в репозитории
- Генерация и рефакторинг кода
- Автоматизация рутинных задач разработки
- Размеры
- 32B – 72B, 35B-A3B
- Железо
- от: 1 видеокарта
Поиск и RAGRU2025–2026
NVIDIA · США
Эмбеддинги NVIDIA для поиска и RAG. Nemotron-3-Embed 2026 года вышли под свободной лицензией OpenMDW и работают на многих языках.
- Поиск по корпоративным документам
- RAG для чат-ботов и ассистентов
- Поиск по картинкам и страницам (VL-версии)
- Размеры
- 1B – 8B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Moonshot AI · Китай
Сверхкрупные MoE-модели Moonshot для агентной работы. K3 на 2,8 трлн параметров — самая большая открытая модель на момент выхода, с контекстом до 1 млн токенов и пониманием картинок; K2.7-Code заточена под программирование.
- Многошаговые агенты: поиск, сбор данных, отчёты
- Глубокий анализ документов
- Помощь программистам
- Размеры
- 16B-A3B – 2.8T-A104B
- Железо
- от: 1 видеокарта
ТекстOllama2024–2026
LG AI Research · Южная Корея
Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.
- Корпоративный ассистент
- Работа с корейскими и английскими текстами
- Разбор документов и картинок (4.5)
- Размеры
- 1.2B – 750B-A37B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Upstage · Южная Корея
Модели корейской Upstage. Solar Open 2 рассчитана на офисную работу с документами: 250 млрд параметров, из них активны 15 млрд, языки — английский, корейский, японский.
- Работа с офисными документами
- Агенты для рутинных задач
- Помощь программистам
- Размеры
- 10.7B – 250B-A15B
- Железо
- от: 1 видеокарта
ТекстGGUF2026
Thinking Machines Lab · США
Флагманские открытые модели лаборатории Миры Мурати: принимают текст, изображения и аудио. Большие MoE, требуют нескольких видеокарт.
- Корпоративный ассистент уровня флагмана
- Разбор документов, изображений и аудио
- Помощь в программировании
- Размеры
- 276B-A12B, 975B-A41B
- Железо
- от: Кластер
КодGGUF2026
Poolside · США
Модели для агентного программирования: самостоятельно правят код в репозитории. Младшая XS запускается на Mac с 36 ГБ памяти, у S 2.1 контекст 1M токенов.
- Агент-программист для внутренней разработки
- Исправление ошибок и доработка кода
- Работа с большими кодовыми базами
- Размеры
- 33B-A3B – 225B-A23B
- Железо
- от: 1 видеокарта
Агенты для компьютераGGUF2025–2026
Microsoft · США
Небольшие модели Microsoft для работы в браузере: смотрят на страницу и кликают, печатают, прокручивают. Рассчитаны на запуск прямо на рабочем компьютере без облака.
- Заполнение веб-форм и заявок
- Сбор данных из веб-кабинетов без API
- Проверка сайтов по сценарию
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
РеранкерыGGUF2024–2026
Jina AI · Германия
Сильные многоязычные реранкеры; m0 сортирует и страницы-картинки (сканы, слайды). Свежие версии открыты только для некоммерческого использования.
- Уточнение выдачи перед ответом чат-бота
- Сортировка найденных страниц PDF и слайдов
- Поиск по каталогу и базе знаний
- Размеры
- 33M – 2.4B
- Железо
- от: Ноутбук
Реранкеры2026
Tencent · Китай
Пара небольших моделей Tencent на базе Qwen3 для подбора ИИ-агенту нужного навыка (skill) под запрос: эмбеддинг находит кандидатов, реранкер выбирает лучший.
- Выбор инструмента или навыка для ИИ-агента
- Маршрутизация запросов между сценариями бота
- Поиск по каталогу внутренних инструментов
- Размеры
- 0.6B
- Железо
- от: Ноутбук
КодGGUF2025–2026
JetBrains · Чехия
Модели JetBrains для быстрого автодополнения кода. Mellum2 (12B, активны 2.5B) уже полноценный помощник: пишет и правит код, вызывает инструменты, рассуждает.
- Быстрое автодополнение кода на своём сервере
- Помощник разработчика без отправки кода в облако
- Дообучение на коде компании
- Размеры
- 4B – 12B-A2.5B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025–2026
Open Thoughts (Стэнфорд, Беркли и другие университеты) · США
Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики регламентов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
ТекстRUGGUF2025–2026
MiniMax · Китай
Крупные MoE-модели с очень длинным контекстом (до 1 млн токенов у Text-01 и M3). M3 — мультимодальная, понимает картинки. Лицензии сильно различаются от версии к версии.
- Анализ больших архивов документов за один запрос
- Агенты с инструментами
- Помощь программистам
- Размеры
- 230B-A10B – 456B-A46B
- Железо
- от: Кластер
Поиск и RAGRUGGUF2023–2026
Jina AI · Германия
Сильные многоязычные эмбеддинги с длинным контекстом, v5-omni понимает текст, картинки и аудио. Свежие версии открыты только для некоммерческого использования.
- Поиск по документам на многих языках
- Поиск по картинкам и сканам
- Классификация и кластеризация
- Размеры
- 33M – 3.8B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Cognitive Computations (Эрик Хартфорд) · США
Дообучения без встроенной цензуры поверх Llama, Mistral, Qwen и других: модель выполняет почти любые запросы. Ответственность за фильтрацию и модерацию полностью на том, кто её внедряет, — без своего фильтра клиентам её не показывать.
- Ассистент, который не отказывает в законных, но «острых» темах
- Внутренние инструменты под жёстким системным промптом
- Ролевые и творческие сценарии
- Размеры
- 0.5B – 405B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
StepFun · Китай
MoE-модели StepFun, рассчитанные на быструю и дешёвую работу: при 196 млрд параметров Step-3.5/3.7-Flash задействуют около 11 млрд на токен. Есть компактные Step3-VL-10B для картинок и голосовая Step-Audio 2 mini.
- Агенты с высокой нагрузкой
- Разбор документов со схемами и скриншотами
- Помощь программистам
- Размеры
- 8B – 321B
- Железо
- от: 1 видеокарта
Агенты для компьютераGGUF2025–2026
H Company · Франция
Французское семейство моделей для управления браузером и компьютером: точно находит нужный элемент на экране и ведёт многошаговые задачи. Свежие Holo3 и 3.1 открыты под Apache 2.0.
- Работа в веб-кабинетах и старых программах без API
- Заполнение форм и заявок
- Проверка интерфейсов по сценарию
- Размеры
- 0.8B – 235B-A22B
- Железо
- от: Ноутбук
Реранкеры2025–2026
NVIDIA · США
Небольшой реранкер NVIDIA на 1B. У версии vl на вход идут и страницы документов картинками, а не только текст. В карточке заявлена многоязычность без списка языков.
- Переупорядочивание фрагментов перед ответом ИИ-помощника
- Сортировка найденных страниц сканов и PDF
- Поиск по внутренним регламентам и инструкциям
- Размеры
- 1B
- Железо
- от: Ноутбук
Прогнозы2024–2026
THUML, Университет Цинхуа · Китай
Компактная базовая модель прогнозов от лаборатории Цинхуа: обучена на большом наборе разнородных рядов и дообучается под свои данные.
- Прогноз спроса и нагрузки
- Прогноз показаний датчиков на производстве
- Дообучение прогноза под свою историю
- Размеры
- 84M (timer-base)
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024–2026
IBM · США
Лёгкие эмбеддинги IBM для корпоративного поиска, обученные на данных с понятными правами. R2 2026 года стали многоязычными.
- Поиск по корпоративным документам
- RAG на обычном сервере без видеокарты
- Переранжирование результатов
- Размеры
- 30M – 311M
- Железо
- от: Ноутбук
ПрогнозыGGUF2025–2026
Datadog · США
Модель прогнозов от Datadog, обученная на метриках серверов и приложений. Особенно сильна для IT-мониторинга: нагрузка, задержки, ошибки.
- Прогноз нагрузки на серверы
- Поиск аномалий в метриках
- Планирование мощностей
- Размеры
- 4M – 2.5B
- Железо
- от: Ноутбук
ТекстRUGGUF2025–2026
Arcee AI · США
Американское семейство MoE-моделей, обученных с нуля: Nano, Mini и Large. Trinity-Large-Thinking на 398B рассуждает перед ответом.
- Агенты с вызовом инструментов
- Задачи с рассуждением
- Корпоративный ассистент на своих серверах
- Размеры
- 6B – 398B-A13B
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2024–2026
IBM · США
Модели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.
- Проверка запросов и ответов бота
- Поиск выдуманных фактов в ответах по базе знаний
- Проверка своих правил, заданных текстом
- Размеры
- 38M – 8B
- Железо
- от: Ноутбук
Агенты для компьютера2024–2026
Show Lab (Национальный университет Сингапура) · Сингапур
Лёгкая модель для работы с интерфейсом: находит кнопки и поля по описанию и выполняет действия в вебе и на телефоне. ShowUI-π умеет перетаскивание мышью.
- Клики и заполнение форм по описанию задачи
- Автотесты веб-интерфейсов
- Помощник на слабом компьютере без облака
- Размеры
- 2B (ShowUI), около 500M (ShowUI-π)
- Железо
- от: Ноутбук
Синтез речи2025–2026
Kyutai · Франция
Потоковые модели распознавания и синтеза речи от авторов Moshi: начинают говорить и расшифровывать, не дожидаясь конца фразы. Pocket TTS (100M) работает на процессоре. Английский, французский и ещё несколько европейских языков, русского нет.
- Потоковая расшифровка речи для голосовых ботов
- Озвучка ответов с минимальной задержкой
- Синтез речи на сервере без видеокарты (Pocket TTS)
- Размеры
- 100M (Pocket TTS) – 2.6B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
ServiceNow · США
Модели ServiceNow на 15B с пошаговыми рассуждениями, которые помещаются на одну видеокарту. С версии 1.5 понимают и картинки, хорошо вызывают инструменты.
- Ассистент с рассуждениями для внутренних сервисов
- Вызов инструментов и корпоративные агенты
- Разбор скриншотов и документов с картинками
- Размеры
- 5B – 15B
- Железо
- от: Ноутбук
КодOllama2025–2026
Essential AI · США
Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.
- Генерация и исправление кода
- Агент-разработчик на одной видеокарте
- Решение технических и научных задач
- Размеры
- 8B
- Железо
- от: Ноутбук
Поиск и RAGGGUF2025–2026
Octen · США / Сингапур
Дообученные Qwen3-Embedding от стартапа Octen под поиск в юридических, финансовых и медицинских текстах. Версия 8B на январь 2026 возглавляла рейтинг RTEB.
- Поиск по договорам и судебной практике
- Поиск по финансовым отчётам
- Поиск по длинным документам до 32 тыс. токенов
- Размеры
- 0.6B – 8B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовRU2025–2026
SberDevices (ai-forever) · Россия
Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.
- Автоматическая проверка качества ответов чат-бота на русском
- Сравнение нескольких моделей перед выбором
- Контроль ответов после дообучения
- Размеры
- 4B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025–2026
Принстонский университет · США
Открытые модели для формальных доказательств в Lean 4 из Принстона. Свежая Goedel-Code-Prover доказывает корректность программ.
- Формальная проверка математических выкладок
- Проверка корректности кода
- Обучение
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Поиск и RAGGGUF2026
Perplexity · США
Эмбеддинги поискового сервиса Perplexity. Есть версии, которые учитывают контекст всего документа, а не только отдельного фрагмента.
- Поиск по большим массивам документов
- RAG с учётом контекста документа
- Поиск по сайту и каталогу
- Размеры
- 0.6B – 4B
- Железо
- от: Ноутбук
Голос: спикеры и звукRU2026
FireRedTeam (Xiaohongshu) · Китай
Детектор речи и звуковых событий: отличает речь, пение и музыку. В тесте на 102 языках (набор FLEURS, русский входит) обошёл Silero VAD и TEN VAD. Есть потоковый режим.
- Нарезка записей перед распознаванием речи
- Отделение речи от музыки и пения в эфирах и роликах
- Определение речи в голосовых ботах
- Размеры
- компактная, точный размер не указан
- Железо
- от: Ноутбук
Поиск и RAGRU2026
Microsoft · США
Многоязычные эмбеддинги Microsoft 2026 года с контекстом до 32 тыс. токенов, русский в списке языков. Версии 270M и 0.6B идут на обычном сервере, 27B — самая точная.
- Поиск по базе знаний на разных языках
- Подбор фрагментов для RAG
- Поиск по длинным документам
- Размеры
- 270M – 27B
- Железо
- от: Ноутбук
КодOllama2024–2026
Alibaba (команда Qwen) · Китай
Самая широкая открытая линейка для кода: от 0.5B для автодополнения до 480B для агентов. Qwen3-Coder-Next (80B, активны 3B) работает как агент-разработчик на одной видеокарте.
- Автодополнение кода в редакторе
- Агент, который сам правит код в репозитории
- Генерация и доработка скриптов, SQL, интеграций
- Размеры
- 0.5B – 480B-A35B
- Железо
- от: Ноутбук
КодGGUF2026
IQuest Research · Китай
Семейство моделей для кода с обычными и рассуждающими версиями, в том числе вариант Loop с повторным проходом по слоям. Размеры от 7B до 40B.
- Генерация и доработка кода
- Решение задач с пошаговыми рассуждениями
- Агентная работа с репозиторием
- Размеры
- 7B – 40B
- Железо
- от: Ноутбук
Код2026
Ai2 (Allen Institute for AI) · США
Полностью открытые агенты-разработчики от Ai2: открыты веса, данные и рецепт обучения. Задуманы так, чтобы компания могла дешево доучить агента на своём репозитории.
- Агент для исправления задач в коде
- Дообучение агента под внутренний репозиторий
- Автоматизация мелких правок и тестов
- Размеры
- 8B – 32B
- Железо
- от: Ноутбук
Голосовые ассистенты2024–2026
Kyutai · Франция
Голосовой ассистент, который слушает и говорит одновременно, без задержки на распознавание и синтез. Hibiki — синхронный перевод речи в речь между несколькими европейскими языками.
- Голосовой собеседник в реальном времени
- Синхронный перевод речи
- Голосовые интерфейсы без задержки
- Размеры
- 2B – 7B
- Железо
- от: Ноутбук
Голосовые ассистентыGGUF2025–2026
OpenBMB (ModelBest, Университет Цинхуа) · Китай
Небольшая модель, которая видит, слышит и отвечает голосом в реальном времени, может клонировать голос. Голосовой диалог на английском и китайском, текст — на 30+ языках.
- Голосовой ассистент на своём сервере
- Разбор видео и документов
- Ответы голосом по картинке с камеры
- Размеры
- 8B – 9B
- Железо
- от: Ноутбук
Агенты для компьютера2025–2026
Alibaba (Tongyi Lab, X-PLUG) · Китай
Модели для управления телефоном и компьютером из проекта Mobile-Agent: работают с Android, Windows, macOS и браузером, в версии 1.5 есть режим с рассуждением.
- Автоматизация действий в мобильных приложениях
- Работа в настольных программах без API
- Тестирование приложений по сценарию
- Размеры
- 2B – 32B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2025–2026
Alibaba (Qwen) · Китай
Эмбеддинги и реранкеры на базе Qwen3, в числе лучших открытых для многоязычного поиска, включая русский. VL-версии ищут по картинкам, скриншотам и видео.
- Поиск по базе знаний для RAG
- Переранжирование найденного перед ответом
- Поиск по сканам, слайдам и скриншотам
- Размеры
- 0.6B – 8B
- Железо
- от: Ноутбук
Поиск и RAG2026
Voyage AI (MongoDB) · США
Единственная открытая модель линейки Voyage 4: её векторы совместимы с платными старшими версиями, можно начать локально и позже перейти на API.
- Поиск по документам на своём сервере
- RAG для небольших баз знаний
- Поиск похожих текстов
- Размеры
- около 340M
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Microsoft · США
Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.
- Ассистент на ноутбуке или своём сервере
- Задачи с рассуждением и расчётами
- Разбор изображений и схем (vision-версии)
- Размеры
- 1.3B – 42B-A6.6B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
Prime Intellect · США
Модели, обученные распределённо на видеокартах со всего мира. INTELLECT-3 на 106B дообучена с подкреплением для математики, кода и агентов.
- Задачи с рассуждением и математикой
- Помощь в программировании
- Агенты с вызовом инструментов
- Размеры
- 10B – 106B-A12B
- Железо
- от: 1 видеокарта
Агенты для компьютераGGUF2026
Meituan · Китай
Агент Meituan для управления компьютером, обученный на большом числе смоделированных задач в настольных программах. На выходе даёт клики и ввод с клавиатуры.
- Работа в офисных и старых программах без API
- Перенос данных между системами
- Прогон сценариев для тестов
- Размеры
- 8B – 32B
- Железо
- от: 1 видеокарта
Кибербезопасность2025–2026
Cisco (Foundation AI) · США
Модели Cisco для информационной безопасности на базе Llama 3.1 8B: разбор уязвимостей, угроз и инцидентов. Можно развернуть внутри периметра.
- Разбор отчётов об уязвимостях и угрозах
- Помощь аналитику SOC при инцидентах
- Сопоставление угроз с MITRE ATT&CK
- Размеры
- 8B
- Железо
- от: Ноутбук
Голос: спикеры и звукRU2025–2026
Daily (Pipecat) · США
Определяет по интонации, закончил ли человек мысль или просто сделал паузу, чтобы голосовой бот не перебивал. Версия 3 весит 8 МБ, работает на процессоре и понимает 23 языка, включая русский.
- Голосовой бот не перебивает клиента на паузах
- Быстрый ответ, когда клиент действительно договорил
- Дополнение к обычному детектору речи в голосовых ассистентах
- Размеры
- 8M (v3) – 580M (v1)
- Железо
- от: Ноутбук
КодRUOllama2025
Mistral AI (с All Hands AI) · Франция
Модели Mistral для агентной разработки: сами читают репозиторий, правят файлы и запускают команды. Версия 24B помещается на одну видеокарту.
- Агент-разработчик для исправления задач из трекера
- Доработка внутренних систем по описанию
- Автоматизация рутинных правок в коде
- Размеры
- 24B – 123B
- Железо
- от: 1 видеокарта
Агенты для компьютера2023–2025
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Одна из первых открытых моделей для управления интерфейсом по скриншоту, развитие — AutoGLM-Phone для работы в приложениях смартфона на Android.
- Автоматизация действий в мобильных приложениях
- Работа в веб-интерфейсах без API
- Тестирование приложений по сценарию
- Размеры
- 9B – 18B
- Железо
- от: 1 видеокарта
Агенты для компьютераGGUF2025
Alibaba (Tongyi-MAI) · Китай
Компактные модели Alibaba для работы в интерфейсе смартфона и компьютера: находят элементы и выполняют многошаговые задачи. Малый размер позволяет запуск на обычной видеокарте.
- Автоматизация действий в мобильных приложениях
- Работа в программах без API
- Автотесты интерфейсов
- Размеры
- 2B – 8B
- Железо
- от: Ноутбук
Модерация и безопасность2025
ServiceNow · США
Guard-модель, которая ловит и опасный контент, и атаки на ИИ (prompt injection, джейлбрейки), в том числе в работе агентов с инструментами.
- Проверка запросов к чат-боту на атаки и взлом
- Фильтр опасных ответов модели
- Контроль действий ИИ-агента с инструментами
- Размеры
- 8B
- Железо
- от: Ноутбук
Табличные данныеGGUF2024–2025
Чжэцзянский университет · Китай
Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.
- Ответы на вопросы по таблицам и выгрузкам
- Автоматический разбор данных с написанием кода
- Помощник в BI и внутренней отчётности
- Размеры
- 7B – 72B
- Железо
- от: 1 видеокарта
ТекстOllama2023–2025
Nous Research · США
Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.
- Агенты, вызывающие функции и API
- Извлечение данных в строгом формате JSON
- Ассистент с гибкой настройкой роли и тона
- Размеры
- 3B – 405B
- Железо
- от: Ноутбук
Голос: спикеры и звукRU2020–2025
Silero · Россия
Самый популярный открытый детектор речи: отличает голос от тишины и шума. Обрабатывает фрагмент звука меньше чем за миллисекунду на одном ядре процессора, обучен на записях более чем 6000 языков.
- Нарезка звонков и записей перед распознаванием речи
- Определение, когда клиент говорит, в голосовом боте
- Отсев тишины и шума, экономия на расшифровке
- Размеры
- около 2 МБ
- Железо
- от: Ноутбук
ТекстOllama2025
Deep Cogito · США
Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.
- Чат-ассистент с режимом рассуждений
- Написание кода и вызов инструментов
- Ответы на сложные вопросы по документам
- Размеры
- 3B – 671B
- Железо
- от: Ноутбук
Реранкеры2025
ZeroEntropy · США
Реранкеры на базе Qwen3. В карточке перечислены рабочие области — финансы, право, код, медицина, наука; язык указан английский.
- Уточнение выдачи перед ответом ИИ-помощника
- Сортировка результатов поиска по договорам и отчётам
- Поиск по технической и научной документации
- Размеры
- zerank-2 — 4B (на базе Qwen3-4B), есть уменьшенная версия small
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024–2025
Mixedbread · Германия
Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.
- Поиск по базе знаний
- Переранжирование результатов перед ответом бота
- Поиск по каталогу товаров
- Размеры
- 17M – 1.5B
- Железо
- от: Ноутбук
Поиск по сканам документов2025
Illuin Technology, EPFL, CentraleSupélec · Франция
Компактная (250M) модель для поиска по страницам документов как по картинкам. По данным авторов, не уступает моделям в 10 раз крупнее и работает без видеокарты.
- Поиск по сканам и PDF на слабом сервере
- Индексация архивов документов
- Поиск по слайдам и инструкциям
- Размеры
- 250M
- Железо
- от: Ноутбук
Поиск и RAGOllama2025
Google · США
Маленькая многоязычная модель эмбеддингов на базе Gemma 3, работает даже на телефоне и ноутбуке без интернета.
- Поиск по документам на устройстве
- RAG без отправки данных наружу
- Классификация текстов
- Размеры
- 300M
- Железо
- от: Ноутбук
Поиск и RAGOllama2023–2025
BAAI (Пекинская академия ИИ) · Китай
Одни из самых популярных эмбеддингов для поиска и RAG. Основные версии v1.5 рассчитаны на английский и китайский; для русского у BAAI есть отдельная bge-m3.
- Поиск по документам на английском
- Подбор фрагментов для ответа чат-бота (RAG)
- Поиск по коду (bge-code)
- Размеры
- 24M – 9B
- Железо
- от: Ноутбук
Текст в SQLGGUF2024–2025
Prem AI · Великобритания
Модель текст-в-SQL всего на 1B параметров: задумана для локального запуска, чтобы база данных не уходила во внешние сервисы.
- Локальный перевод вопросов в SQL без выхода в интернет
- Подсказки по запросам на слабом железе
- Встраивание в внутренние инструменты аналитики
- Размеры
- 1B
- Железо
- от: Ноутбук
ТекстOllama2025
OpenAI · США
Первые открытые модели OpenAI со времён GPT-2. Рассуждения, вызов инструментов, младшая версия помещается на одну видеокарту.
- ИИ-агент с вызовом внутренних систем
- Ответы по регламентам
- Черновики писем и отчётов
- Размеры
- 20B, 120B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Moonshot AI и Project Numina · Китай, Франция
Модели для формальных доказательств в Lean 4 от Moonshot AI (Kimi) и Numina. Есть маленькие версии от 0.6B, которые запускаются на ноутбуке.
- Формальная проверка математических выкладок
- Перевод задачи с обычного языка на Lean
- Обучение и олимпиадная подготовка
- Размеры
- 0.6B – 72B
- Железо
- от: Ноутбук
ТекстGGUF2025
ByteDance · Китай
Открытая модель ByteDance на 36B с контекстом до 512 тыс. токенов и настраиваемым «бюджетом размышлений». Помещается на одну мощную видеокарту.
- Разбор длинных документов
- Агенты с инструментами
- Корпоративный ассистент
- Размеры
- 36B
- Железо
- от: 1 видеокарта
Текст2024–2025
xAI · США
xAI выкладывает веса прошлых поколений Grok. Модели очень большие и требуют кластера видеокарт, поэтому на практике их запускают редко.
- Исследования больших моделей
- Ассистент на собственной инфраструктуре
- Генерация и анализ текстов
- Размеры
- 314B (Grok-1), Grok-2 крупнее
- Железо
- от: Кластер
Голос: спикеры и звук2025
Agora (проект TEN) · США / Китай
Лёгкий детектор речи для голосовых ассистентов в реальном времени: быстрее замечает начало и конец фразы, чем Silero VAD. Работает на сервере, телефоне и в браузере.
- Определение речи в голосовом боте без задержек
- Быстрая реакция ассистента на конец фразы
- Работа в мобильных приложениях и браузере
- Размеры
- очень малая, библиотека меньше Silero VAD
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025
Agentica (Беркли, Sky Computing Lab) и Together AI · США
Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.
- Решение математических задач с пошаговым выводом
- Генерация и проверка кода
- Агент для исправления ошибок в репозитории
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Поиск по сканам документов2024–2025
Illuin Technology (команда ViDoRe) · Франция
Поиск по PDF и сканам как по картинкам: страницу не нужно распознавать, модель сразу находит нужную по вопросу, включая таблицы и схемы. Обучены на английском.
- Поиск по сканам, презентациям и PDF
- RAG по документам с таблицами и графиками
- Поиск по технической документации
- Размеры
- 256M – 3B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответов2024–2025
OpenCompass (Шанхайская лаборатория ИИ) · Китай
Линейка судей от команды открытых тестов моделей: оценивают ответы и сверяют их с эталоном. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.
- Оценка ответов моделей по заданным критериям
- Сверка ответа с эталонным решением
- Сравнение нескольких моделей на своих данных
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассуждения2025
NVIDIA · США
Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Разбор задач по программированию
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответов2024–2025
Skywork (Kunlun Tech) · Китай
Модели-оценщики: ставят балл ответу языковой модели, насколько он хорош для пользователя. Нужны для дообучения своих моделей и отбора лучшего из нескольких ответов.
- Выбор лучшего из нескольких ответов бота
- Оценка качества ответов при дообучении модели
- Сравнение моделей перед внедрением
- Размеры
- 0.6B – 27B
- Железо
- от: Ноутбук
КибербезопасностьGGUF2023–2025
Clouditera · Китай
Китайское открытое семейство для кибербезопасности: разбор уязвимостей, анализ логов и трафика, объяснение команд и скриптов.
- Разбор уязвимостей и подготовка рекомендаций по исправлению
- Анализ логов и восстановление цепочки атаки
- Объяснение подозрительных команд и скриптов
- Размеры
- 1.5B – 14B
- Железо
- от: Ноутбук
КибербезопасностьGGUF2025
Trendyol · Турция
Модели безопасности от крупного турецкого маркетплейса, выложены в формате GGUF: разбор алертов и инцидентов, английский и турецкий языки.
- Разбор алертов и первичная оценка инцидента
- Объяснение подозрительной активности в отчётах
- Помощь дежурной смене центра мониторинга
- Размеры
- 32B и 70B
- Железо
- от: 1 видеокарта
Текст в SQLGGUF2025
IDEA Research · Китай
Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.
- Запросы к базе по вопросам с несколькими условиями
- Разбор и исправление чужих SQL-запросов
- Помощник аналитика в BI-системе
- Размеры
- 3B – 14B
- Железо
- от: Ноутбук
ТекстOllama2025
DeepSeek · Китай
Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.
- Сложные расчёты и проверка логики
- Анализ договоров и регламентов
- Помощь программистам
- Размеры
- 1,5B – 671B
- Железо
- от: Ноутбук
КодGGUF2025
ByteDance Seed · Китай
Компактная модель для кода 8B от ByteDance: базовая, инструктивная и рассуждающая версии. Данные для обучения отбирала сама модель, почти без ручных правил.
- Автодополнение и генерация кода
- Решение алгоритмических задач
- Основа для дообучения под свой стек
- Размеры
- 8B
- Железо
- от: Ноутбук
КартинкиGGUF2025
ByteDance Seed · Китай
Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.
- Редактирование фото в диалоге
- Ответы на вопросы по изображению
- Генерация картинок с пояснениями
- Размеры
- 14B-A7B
- Железо
- от: 1 видеокарта
Разбор текстаRU2023–2025
deepvk (VK) · Россия
Русские энкодеры от команды VK: RuModernBERT читает длинные тексты, USER даёт векторы для поиска, GeRaCl классифицирует тексты по темам без обучения.
- Классификация обращений без размеченных данных
- Поиск по базе знаний на русском
- Разбор длинных договоров
- Размеры
- 35M – 360M
- Железо
- от: Ноутбук
Текст в SQL2025
Snowflake · США
Модель Snowflake для перевода вопросов в SQL, обученная с подкреплением на проверке результата запроса. Открыта версия 7B на базе Qwen2.5-Coder.
- Вопросы к хранилищу данных на обычном языке
- Генерация SQL для отчётов и дашбордов
- Проверка и исправление запросов аналитиков
- Размеры
- 7B
- Железо
- от: Ноутбук
КодRU2025
МТС AI (MWS AI) · Россия
Маленький помощник программиста от МТС AI, понимает запросы на русском. Работает локально, есть плагины для VS Code и JetBrains.
- Подсказки и дописывание кода в редакторе
- Объяснение кода на русском
- Черновики тестов и документации
- Размеры
- 1.5B
- Железо
- от: Ноутбук
Реранкеры2023–2025
Stanford NLP, затем Answer.AI и LightOn · США и Франция
Другой принцип поиска: каждое слово вопроса сравнивается с каждым словом документа, а не два текста целиком. Индекс получается тяжелее обычных эмбеддингов. В карточках заявлен английский язык.
- Поиск по базе знаний с длинными документами
- Переупорядочивание найденных фрагментов
- Поиск по регламентам и технической документации
- Размеры
- около 33M – 150M
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовRU2024–2025
NVIDIA · США
Крупные оценщики NVIDIA для отбора и дообучения ответов. У мультиязычной версии GenRM в списке языков есть русский. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.
- Отбор лучшего ответа из нескольких вариантов
- Подготовка данных для дообучения своей модели
- Оценка ответов помощника на русском и других языках
- Размеры
- 49B, 70B и 340B
- Железо
- от: Кластер
Прогнозы2025
THUML, Университет Цинхуа · Китай
Модель прогнозов, которая выдаёт не одну линию, а набор возможных сценариев — удобно, когда нужен коридор спроса или нагрузки, а не одно число.
- Прогноз спроса с коридором значений
- Планирование запасов с учётом разброса
- Прогноз нагрузки на сервисы и персонал
- Размеры
- 128M (sundial-base)
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Meta · США
Модели, с которых начался массовый open source в ИИ. Огромная экосистема дообученных версий и инструментов.
- Ассистент для сотрудников
- Суммаризация встреч и документов
- Основа для дообучения под отрасль
- Размеры
- 1B – 405B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2024–2025
DeepSeek · Китай
Модели DeepSeek для формальных доказательств на языке Lean 4: доказательство проверяет программа, а не человек. Узкий инструмент для математиков и инженеров.
- Формальная проверка математических выкладок
- Проверка корректности алгоритмов
- Обучение и олимпиадная подготовка
- Размеры
- 7B – 671B
- Железо
- от: Ноутбук
Модерация и безопасность2024–2025
Meta · США
Крошечные классификаторы, которые ловят попытки взломать бота: промпт-инъекции и обход правил. Версия 86M многоязычная, 22M только английский.
- Защита бота от промпт-инъекций
- Проверка писем и документов, которые попадают в ИИ-агента
- Быстрый фильтр перед большой моделью
- Размеры
- 22M – 86M
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025
ByteDance Seed · Китай
Модель, которая смотрит на скриншот и сама двигает мышью и клавиатурой: кликает, заполняет поля, переходит по меню. Открыты 1-е поколение и 1.5-7B; UI-TARS-2 весов не открыл.
- Работа в старых программах без API
- Заполнение форм и перенос данных между системами
- Автотесты интерфейсов по сценарию на обычном языке
- Размеры
- 2B – 72B
- Железо
- от: Ноутбук
Текст в SQL2025
Alibaba · Китай
Модели Alibaba для перевода вопросов в SQL на базе Qwen2.5-Coder. Работают с разными диалектами SQL, есть малая версия 3B для слабого железа.
- Вопросы к базе на обычном языке
- Запросы к разным СУБД (PostgreSQL, MySQL, SQLite)
- Автоматизация типовых отчётов
- Размеры
- 3B – 32B
- Железо
- от: Ноутбук
КибербезопасностьGGUF2023–2025
Kindo · США
Одно из самых известных открытых семейств для задач безопасности и DevSecOps: разбор кода на уязвимости, сценарии проверок, объяснение атак.
- Поиск слабых мест в коде и конфигурациях
- Разбор инцидентов и объяснение техник атак
- Черновики скриптов и регламентов для команды безопасности
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
КартинкиGGUF2024–2025
NVIDIA · США
Быстрая модель картинок от NVIDIA: 4K-изображения за секунды и работа даже на ноутбучной видеокарте. Версия Sprint генерирует в 1–2 шага.
- Массовая генерация картинок
- Визуалы высокого разрешения
- Генерация в реальном времени в приложениях
- Размеры
- 0.6B – 4.8B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024–2025
Nomic AI · США
Полностью открытые эмбеддинги — с весами, данными и кодом обучения. v2 многоязычная на MoE, есть версии для кода и для поиска по PDF-страницам.
- Поиск по документам и базе знаний
- Поиск по коду
- Поиск по сканам и PDF без распознавания
- Размеры
- 137M – 7B
- Железо
- от: Ноутбук
Синтез речиRUGGUF2023–2025
Rhasspy / Open Home Foundation · США
Очень быстрый синтез речи, который работает даже на Raspberry Pi. Готовые голоса на 35+ языках, есть несколько русских.
- Озвучка уведомлений и ответов бота
- Голос для устройств без интернета
- Голосовые меню
- Размеры
- около 5M – 30M
- Железо
- от: Ноутбук
Синтез речиGGUF2025
Canopy Labs · США
Синтез речи на основе языковой модели с живыми интонациями и эмоциональными вставками. Быстро отвечает, подходит для голосовых ассистентов. В основном английский.
- Голос для ассистента в реальном времени
- Эмоциональная озвучка
- Клонирование голоса
- Размеры
- 3B
- Железо
- от: Ноутбук
Синтез речиGGUF2025
Sesame · США
Модель разговорной речи, которая учитывает контекст беседы и звучит как живой собеседник. Только английский.
- Голос для разговорного ассистента
- Озвучка диалогов
- Прототипы голосовых продуктов
- Размеры
- 1B
- Железо
- от: Ноутбук
Текст в SQL2025
Renmin University of China (RUC) · Китай
Модели для перевода вопросов в SQL, обученные на миллионах синтетических примеров запросов к разным базам. Три размера под разное железо.
- Вопросы к базе данных без знания SQL
- Генерация запросов для отчётов
- Основа для дообучения под свою схему базы
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Агенты для компьютера2024–2025
Salesforce · США
Модели Salesforce для вызова функций и работы агентов: выбирают нужный инструмент и заполняют его параметры. Сильны в тестах, но лицензия некоммерческая.
- Вызов API и внутренних сервисов по запросу пользователя
- Агенты с несколькими шагами и инструментами
- Сравнение подходов перед выбором коммерческой модели
- Размеры
- 1B – 8x22B
- Железо
- от: Ноутбук
Компьютерное зрение2023–2025
Google · США
Модели, которые переводят картинки и текст в общее пространство: можно искать фото по словам и классифицировать изображения без обучения. CLIP от OpenAI (2021) — предшественник.
- Поиск картинок по текстовому запросу
- Автоматическая разметка и теги каталога
- Фильтрация недопустимого контента
- Размеры
- около 0.2B – 2B
- Железо
- от: Ноутбук
Синтез речиGGUF2024–2025
hexgrad (независимый разработчик) · не указана
Крошечная модель синтеза речи (82M), которая звучит на уровне крупных. Работает на обычном процессоре; английский и ещё несколько языков, русского нет.
- Озвучка статей и уведомлений
- Голос для приложений без видеокарты
- Массовая озвучка текстов
- Размеры
- 82M
- Железо
- от: Ноутбук
Агенты для компьютера2024–2025
Microsoft · США
Разбирает скриншот на кнопки, поля и иконки с подписями, чтобы обычная языковая модель понимала экран и могла им управлять. Сам не кликает, а служит «глазами» агента.
- Разметка экранов старых программ для автоматизации
- Подготовка агента к работе в интерфейсе
- Проверка, что на экране есть нужные элементы
- Размеры
- менее 1B (детектор + подписи)
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025
Microsoft Research · США
Модель-агент, которая одинаково планирует действия и в интерфейсе (кнопки на экране), и для робота (движения манипулятора). Пока скорее исследовательская база, чем готовый продукт.
- Пилоты по управлению интерфейсом
- Исследовательские проекты на стыке экрана и робототехники
- Разбор скриншотов с планом действий
- Размеры
- 8B
- Железо
- от: 1 видеокарта
Поиск и RAGRU2023–2025
Alibaba · Китай
Эмбеддинги и реранкеры Alibaba для поиска: от крошечных до 7B на базе Qwen2. Есть многоязычная версия mGTE с длинным контекстом.
- Смысловой поиск по документам
- Переранжирование результатов поиска
- Кластеризация и классификация текстов
- Размеры
- 33M – 7B
- Железо
- от: Ноутбук
Разбор текстаGGUF2024–2025
Answer.AI и LightOn · США / Франция
Современная замена классическому BERT: быстрее, читает до 8 тысяч токенов за раз. Основа для своих классификаторов. Обучена на английском и коде, для русского есть RuModernBERT.
- Классификация обращений и документов
- Поиск нужных фрагментов в длинных текстах
- Основа для своего классификатора после дообучения
- Размеры
- 150M – 395M
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2019–2025
UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия
Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.
- Поиск по базе знаний и FAQ
- Поиск похожих обращений и дублей
- Группировка отзывов и заявок по темам
- Размеры
- около 20M – 470M
- Железо
- от: Ноутбук
Разбор текстаRUOllama2024–2025
Jina AI · Германия
Маленькие модели, которые превращают сырой HTML веб-страниц в чистый Markdown или JSON. Удобно готовить сайты для базы знаний. Лицензия только некоммерческая.
- Очистка страниц сайтов для базы знаний
- Извлечение данных со страниц в JSON
- Подготовка текстов для RAG
- Размеры
- 0.5B – 1.5B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответов2025
Atla · Великобритания
Модель-судья на 8B: оценивает ответ другой модели по вашим критериям и пишет обоснование. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.
- Оценка ответов чат-бота по своим критериям
- Сравнение двух версий подсказки или модели
- Отбраковка слабых ответов перед отправкой человеку
- Размеры
- 8B
- Железо
- от: 1 видеокарта
Поиск и RAGRUOllama2024
Snowflake · США
Эмбеддинги от Snowflake, заточенные именно под поиск. Версия 2.0 многоязычная (русский в списке языков), держит длинные тексты до 8 тыс. токенов и умеет сжимать векторы.
- Поиск по документам и базе знаний
- Подбор фрагментов для RAG
- Поиск по отчётам и внутренним данным
- Размеры
- 22M – 568M
- Железо
- от: Ноутбук
Поиск по сканам документов2024
Alibaba (Tongyi Lab) · Китай
Один вектор и для текста, и для картинки, и для их пары: одной моделью можно искать товар по фото, страницу документа по вопросу и картинку по описанию. Языки в карточке: английский и китайский.
- Поиск товара по фотографии
- Поиск по каталогу картинок и карточек
- Поиск по страницам документов как по изображениям
- Размеры
- 2B и 7B
- Железо
- от: 1 видеокарта
Проверка фактов и оценка ответов2024
Patronus AI · США
Небольшой судья: ставит оценку по вашим критериям и показывает, какой кусок ответа к ней привёл. Лицензия некоммерческая. Судья сам ошибается и ручную проверку не заменяет.
- Оценка ответов по своим критериям с пояснением
- Разбор, за что снижена оценка
- Массовая проверка диалогов помощника
- Размеры
- 3.8B (на базе Phi-3.5-mini)
- Железо
- от: Ноутбук
КодOllama2024
INF Technology · Китай
Полностью воспроизводимые модели для кода: вместе с весами открыты данные, конвейер их очистки и рецепт обучения. Понимают английский и китайский.
- Генерация и дополнение кода
- Обучение своей модели для кода по открытому рецепту
- Ассистент программиста на слабом железе
- Размеры
- 1.5B – 8B
- Железо
- от: Ноутбук
ТекстOllama2024
Nexusflow · США
Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.
- Исследование агентов и вызова функций
- Сравнение с коммерческими моделями
- Эксперименты с чат-ассистентом
- Размеры
- 70B – 72B
- Железо
- от: 1 видеокарта
Поиск по сканам документов2024
LightOn · Франция
Реранкер для страниц-картинок: после визуального поиска переставляет найденные страницы по тому, насколько они отвечают на вопрос. Языки в карточке не указаны.
- Уточнение выдачи поиска по сканам и PDF
- Отбор страниц перед ответом ИИ-помощника
- Сортировка найденных слайдов и отчётов
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
Прогнозы2024
Auton Lab, Университет Карнеги — Меллона · США
Базовая модель для рядов чисел: один движок используют и для прогноза, и для поиска аномалий, и для заполнения пропусков, и для классификации.
- Прогноз спроса и загрузки
- Поиск аномалий в показаниях датчиков и метриках
- Заполнение пропусков в исторических данных
- Размеры
- около 40M – 385M
- Железо
- от: Ноутбук
Прогнозы2024
IBM Research · США
Крошечные модели прогнозов от IBM: считаются на обычном процессоре, их ставят рядом с бизнес-системой без отдельного сервера с видеокартой.
- Прогноз продаж и остатков на складе
- Прогноз энергопотребления и нагрузки оборудования
- Быстрые прогнозы прямо на сервере компании
- Размеры
- очень маленькие: у TinyTimeMixers около 1M параметров
- Железо
- от: Ноутбук
КодOllama2023–2024
DeepSeek · Китай
Линейка моделей для кода от DeepSeek: от маленьких для автодополнения до большой MoE V2, которая в 2024 году была на уровне закрытых моделей. Позже код ушёл в общие модели DeepSeek.
- Автодополнение и генерация кода
- Перевод кода между языками
- Поиск ошибок и объяснение чужого кода
- Размеры
- 1.3B – 236B-A21B
- Железо
- от: Ноутбук
КодOllama2024
01.AI · Китай
Модели для кода от 01.AI на 1.5B и 9B с контекстом 128 тыс. токенов и поддержкой 52 языков программирования. Отдельная линейка рядом с текстовыми Yi.
- Автодополнение и генерация кода
- Объяснение и рефакторинг кода
- Ассистент программиста без облака
- Размеры
- 1.5B – 9B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответов2024
Flow AI · не раскрыта
Маленькая модель-судья: проверяет ответ по вашей инструкции и ставит оценку с пояснением. Помещается на скромный сервер. Судья сам ошибается и ручную проверку не заменяет.
- Проверка ответов ИИ-помощника на соответствие инструкции
- Массовая оценка выгрузки диалогов
- Контроль качества перед выкаткой изменений
- Размеры
- 3.8B (на базе Phi-3.5-mini)
- Железо
- от: Ноутбук
Прогнозы2024
Команда Time-MoE · не раскрыта
Модель прогнозов с разреженной архитектурой: на каждом шаге работает лишь часть сети, поэтому она остаётся быстрой при небольшом размере.
- Прогноз продаж и остатков
- Прогноз нагрузки на сервисы и персонал
- Планирование закупок по истории
- Размеры
- 50M и 200M
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
Stability AI · Великобритания
Малые модели Stability AI: StableLM 2 на 1.6B знает 7 европейских языков, Stable Code на 3B дописывает код. Обновлений с 2024 года нет.
- Лёгкий чат-бот на обычном ПК
- Автодополнение кода в редакторе
- Основа для дообучения под свою задачу
- Размеры
- 1.6B – 12B
- Железо
- от: Ноутбук
КодOllamaНе развивается2024
Mistral AI · Франция
Модель Mistral для кода на 80+ языках программирования. Открытые веса основной версии нельзя использовать в работе без платной лицензии; новые версии Codestral только по API.
- Оценка и тесты перед покупкой лицензии
- Автодополнение кода (при коммерческой лицензии)
- Исследование качества моделей для кода
- Размеры
- 7B – 22B
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2020–2024
SberDevices (ai-forever) · Россия
Русскоязычные энкодеры Сбера, обученные на больших русских корпусах. Основа для классификаторов, NER и поиска по смыслу на русском.
- Классификация обращений на русском
- Извлечение имён, сумм и дат после дообучения
- Определение тональности отзывов
- Размеры
- около 30M – 430M
- Железо
- от: Ноутбук
КодOllamaНе развивается2023–2024
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Модели для кода от создателей GLM. CodeGeeX4-ALL-9B на базе GLM-4-9B в одной модели совмещает автодополнение, чат по коду, вызов функций и поиск по репозиторию.
- Автодополнение кода в IDE
- Чат-помощник по коду
- Ответы на вопросы по репозиторию
- Размеры
- 6B – 9B
- Железо
- от: Ноутбук
РеранкерыGGUFНе развивается2023–2024
BAAI (Пекинская академия ИИ) · Китай
Реранкеры: берут найденные поиском фрагменты и переставляют их по реальной близости к вопросу. Версия v2-m3 многоязычная и лёгкая, её часто ставят в пару к bge-m3.
- Уточнение выдачи перед ответом чат-бота
- Сортировка результатов поиска по базе знаний
- Отбор самых подходящих пунктов договоров и регламентов
- Размеры
- 278M – 9B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовНе развивается2024
Patronus AI · США
Проверяет, не придумал ли чат-бот факт, которого нет в исходных документах. Лицензия некоммерческая. Проверяющая модель сама ошибается и ручную проверку на важных задачах не заменяет.
- Поиск выдуманных фактов в ответах ИИ-помощника
- Проверка ответов на опору в приложенных документах
- Отбраковка ответов перед отправкой клиенту
- Размеры
- 8B и 70B
- Железо
- от: 1 видеокарта
ТекстOllamaНе развивается2023–2024
OpenChat (Университет Цинхуа) · Китай
Дообучения Mistral 7B и Llama 3 8B по методу C-RLFT, которые в 2023–2024 годах догоняли ChatGPT-3.5 при размере 7–8B. Лёгкий универсальный ассистент для слабого сервера.
- Чат-ассистент на недорогом сервере
- Черновики писем и ответов
- Помощь с простым кодом
- Размеры
- 7B – 13B
- Железо
- от: Ноутбук
Текст в SQLOllamaНе развивается2023–2024
Defog · США
Одна из первых открытых моделей, которые переводят вопрос на обычном языке в SQL-запрос к базе. Есть в Ollama, но свежие конкуренты уже сильнее.
- Ответы на вопросы менеджеров по базе продаж без аналитика
- Черновики SQL-запросов для отчётов
- Помощник внутри BI-системы
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовНе развивается2024
RLHFlow · США
Оценщик ответов, который выдаёт не один общий балл, а разбор сразу по нескольким признакам. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.
- Отбор лучшего из нескольких вариантов ответа
- Подготовка данных для дообучения модели
- Оценка ответов помощника по нескольким признакам
- Размеры
- 8B
- Железо
- от: 1 видеокарта
КодOllamaНе развивается2023–2024
BigCode (Hugging Face и ServiceNow) · США / Франция
Одна из первых открытых моделей для кода, обучена на открытом наборе исходников с возможностью исключить свой репозиторий. Сегодня скорее база для дообучения, чем лидер.
- Автодополнение кода в редакторе
- Дообучение на внутреннем коде компании
- Генерация шаблонного кода и тестов
- Размеры
- 1B – 15B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовНе развивается2023–2024
KAIST и LG AI Research (prometheus-eval) · Южная Корея
Открытая модель-судья: оценивает ответы других моделей по вашим критериям и объясняет оценку. Замена платным моделям в роли проверяющего.
- Оценка ответов чат-бота по своей шкале
- Сравнение двух вариантов ответа
- Проверка качества перед запуском ИИ-сервиса
- Размеры
- 7B – 8x7B
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2024
Chat2DB · Китай
Модель текст-в-SQL из открытого инструмента работы с базами Chat2DB: поддерживает разные диалекты SQL, карточка на английском и китайском.
- Перевод вопроса в SQL внутри клиента базы данных
- Черновики запросов под разные СУБД
- Подсказки разработчику при работе со схемой
- Размеры
- 7B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
TinyLlama (исследователи SUTD) · Сингапур
Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.
- Простые чат-боты на слабом железе
- Эксперименты и обучение команды
- Основа для дообучения под узкую задачу
- Размеры
- 1.1B
- Железо
- от: Ноутбук
КибербезопасностьGGUFНе развивается2023–2024
ZySec AI · Индия
Небольшой открытый помощник для специалистов по безопасности: вопросы по стандартам, разбор угроз и уязвимостей, подготовка внутренних документов.
- Ответы на вопросы по политикам и стандартам безопасности
- Первичный разбор сообщений об угрозах
- Черновики внутренних инструкций по защите
- Размеры
- 2.8B и 7B
- Железо
- от: Ноутбук
Поиск и RAGRUНе развивается2022–2024
Microsoft · США
Проверенные модели для смыслового поиска. Многоязычные версии хорошо работают с русским и до сих пор служат надёжной основой для RAG.
- Поиск по базе знаний и документам
- Подбор ответов для чат-бота (RAG)
- Поиск похожих обращений и дублей
- Размеры
- 33M – 7B
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2024
ChatDB · США
Модель текст-в-SQL на базе DeepSeek-Coder, рассчитанная на сложные вопросы с несколькими таблицами и условиями.
- Сложные запросы с соединением нескольких таблиц
- Ответы на вопросы по базе без аналитика
- Черновики SQL для отчётов и выгрузок
- Размеры
- 7B
- Железо
- от: Ноутбук
КодOllamaНе развивается2023–2024
Meta · США
Версия Llama 2, доученная на коде; есть варианты для Python и для диалога. Устарела, но много готовых дообученных версий и инструментов.
- Автодополнение и объяснение кода
- Генерация скриптов на Python
- Базовая модель для дообучения под свой стек
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
WizardLM (Microsoft и Пекинский университет) · США / Китай
Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.
- Сложные многошаговые инструкции
- Помощь программистам
- Решение математических задач
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
Текст в SQLOllamaНе развивается2024
MotherDuck и Numbers Station · США
Модель для перевода вопросов в SQL, заточенная под встраиваемую аналитическую базу DuckDB. Есть в Ollama, удобна для локальной работы с CSV и Parquet.
- Вопросы к выгрузкам CSV и Parquet на обычном языке
- Запросы к DuckDB внутри аналитических скриптов
- Быстрая аналитика на ноутбуке без сервера
- Размеры
- 7B
- Железо
- от: Ноутбук
РеранкерыGGUFНе развивается2023–2024
Университет Ватерлоо, группа Castorini · Канада
Реранкеры-языковые модели: получают сразу список найденных фрагментов и переставляют его целиком, а не оценивают фрагменты по одному. Тяжелее обычных реранкеров.
- Переупорядочивание длинной выдачи поиска
- Отбор источников для ответа ИИ-помощника
- Исследовательские сравнения способов поиска
- Размеры
- 7B – 13B
- Железо
- от: 1 видеокарта
РеранкерыНе развивается2023
NetEase Youdao · Китай
Пара «эмбеддинг плюс реранкер» для баз знаний. В карточке заявлены английский, китайский, японский и корейский — русского в списке языков нет.
- Поиск по базе знаний и справочным материалам
- Переупорядочивание найденных фрагментов
- Подбор ответов для чат-бота поддержки
- Размеры
- около 280M
- Железо
- от: Ноутбук
Синтез речиНе развивается2023
Колумбийский университет · США
Лёгкая модель синтеза английской речи с естественной интонацией. На её основе построены многие другие модели, например Kokoro.
- Озвучка текстов на английском
- Основа для дообучения своего голоса
- Прототипы голосовых сервисов
- Размеры
- около 150M
- Железо
- от: Ноутбук
Текст в SQLНе развивается2023
RUCKBReasoning, Китайский народный университет · Китай
Ранняя линейка открытых моделей текст-в-SQL размером от 1B: есть варианты, дообученные под конкретные схемы баз данных.
- Перевод вопроса сотрудника в SQL-запрос
- Черновики запросов к хранилищу под отчёт
- Встраивание в BI-панель как подсказчик
- Размеры
- 1B – 15B
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2023
Numbers Station · США
Одна из первых открытых линеек текст-в-SQL, включая совсем маленькие версии от 350M, которые запускаются на обычном ПК.
- Перевод вопроса в SQL по описанию таблиц
- Подсказки при написании запросов
- Локальный помощник аналитика без передачи данных наружу
- Размеры
- 350M – 7B
- Железо
- от: Ноутбук
РеранкерыRUНе развивается2022
UKP Lab и сообщество Sentence Transformers · Германия
Самые скачиваемые открытые реранкеры: крошечная модель читает пару «вопрос — найденный фрагмент» и ставит оценку близости. Многоязычная версия mMARCO знает русский.
- Переупорядочивание результатов поиска по базе знаний
- Отбор фрагментов перед ответом чат-бота
- Поиск дублей среди обращений и карточек товаров
- Размеры
- около 4M – 120M
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2019–2022
Meta · США
Классический многоязычный энкодер на 100 языков, включая русский. Основа многих моделей тональности, NER и эмбеддингов, в том числе BGE-M3.
- Определение тональности отзывов на разных языках
- Извлечение имён и организаций после дообучения
- Классификация обращений
- Размеры
- 270M – 10.7B
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2021
Microsoft · США
Проверенный временем энкодер, на котором построено множество классификаторов и NER-моделей (в том числе GLiNER). Многоязычная mDeBERTa-v3 понимает русский.
- Классификация отзывов по тональности
- Извлечение сущностей после дообучения
- Проверка, следует ли вывод из текста
- Размеры
- 70M – 435M
- Железо
- от: Ноутбук
Разбор текстаRUНе развивается2021
Давид Дале (cointegrated) · Россия
Очень маленький русско-английский BERT, работает быстро на обычном процессоре. Есть готовые дообученные версии для тональности, токсичности и эмоций.
- Определение тональности отзывов
- Фильтр грубых сообщений в чате
- Быстрая классификация обращений
- Размеры
- 12M – 29M
- Железо
- от: Ноутбук