Модели, доступные в Ollama

В подборке модели, которые есть в библиотеке Ollama и запускаются одной командой на компьютере или сервере. Это самый простой путь попробовать локальный ИИ и подключить его к своим сервисам через API. Выбирайте размер версии под объём памяти и проверяйте лицензию модели, ведь Ollama её не меняет.

В подборке 78 семейств открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
ТекстOllama2023–2026

DeepSeek

DeepSeek · Китай

Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.

  • Ассистент для сотрудников на своём сервере
  • Разбор длинных договоров и отчётов
  • Агенты, которые работают с инструментами и API
Размеры
7B – 1.6T-A49B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2026

InternLM / Intern-S

Shanghai AI Laboratory · Китай

Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.

  • Помощник исследователя: статьи, формулы, данные
  • Разбор научных и технических документов
  • Корпоративный чат на малых моделях
Размеры
1.8B – около 1T
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2024–2026

Aya

Cohere Labs · Канада

Многоязычные модели исследовательского крыла Cohere, от 23 до 100+ языков. Tiny Aya 2026 года на 3.3B работает на обычном ПК, но только некоммерчески.

  • Перевод и переписка на редких языках
  • Многоязычный чат-ассистент
  • Разбор изображений с текстом (Vision)
Размеры
3.3B – 35B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Qwen

Alibaba · Китай

Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.

  • Чат-бот и ассистент по базе знаний
  • Ответы на письма и обращения
  • Разбор и классификация документов
Размеры
0,6B – 2,4T-A95B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2026

GLM (ChatGLM)

Zhipu AI (Z.ai) · Китай

Одна из старейших китайских открытых линий: от ChatGLM-6B до GLM-5.3. Сильна в агентных задачах и программировании; GLM-5.3-Flash понимает картинки и выходит под MIT.

  • Корпоративный чат-ассистент
  • Агенты для рутинных офисных задач
  • Помощь программистам
Размеры
1.5B – 744B-A40B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2024–2026

Cohere Command

Cohere · Канада

Модели для бизнеса: поиск по документам со ссылками на источники, вызов инструментов, много языков. Command A+ 2026 года впервые вышла под Apache 2.0, за ней — линейка North: код, перевод и компактное зрение.

  • Ответы по базе знаний со ссылками на источники
  • Агенты, работающие с внутренними системами
  • Перевод и переписка на разных языках
Размеры
2.5B – 218B-A25B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

NVIDIA Nemotron

NVIDIA · США

Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).

  • Агенты с вызовом инструментов
  • Задачи с рассуждением и расчётами
  • Ответы по длинным документам
Размеры
4B – 550B-A55B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

IBM Granite

IBM · США

Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.

  • Ответы по внутренним документам (RAG)
  • Вызов инструментов и работа в агентах
  • Извлечение данных и классификация
Размеры
350M – 34B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2025–2026

Liquid LFM

Liquid AI · США

Модели новой архитектуры для работы прямо на устройстве: быстрые на обычном процессоре и в телефоне. Есть версии для извлечения данных, RAG и инструментов, а также LFM2.5-VL для картинок и голосовая LFM2.5-Audio.

  • Ассистент на ноутбуке или телефоне без интернета
  • Извлечение данных из документов
  • Вызов инструментов в приложениях
Размеры
230M – 24B-A2B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2026

Muse Glimmer

Meta Superintelligence Labs · США

Открытая модель Meta для агентов на доступном железе: дистиллирована из закрытой Muse Spark, понимает текст и картинки, обучена на 100+ языках.

  • Агенты с вызовом инструментов
  • Разбор скриншотов, графиков и документов
  • Многоязычный ассистент
Размеры
30B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
КодOllama2026

Ornith

DeepReinforce · не раскрыта

Модели для агентной разработки: сами строят план и обвязку под задачу и выполняют её в терминале. Дообучены на базе Qwen 3.5 и Gemma 4, работают с Claude Code, OpenHands и похожими инструментами.

  • Агент-разработчик в терминале
  • Исправление ошибок по описанию задачи
  • Разбор и доработка большого репозитория
Размеры
9B – 397B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Mistral

Mistral AI · Франция

Европейские модели с упором на скорость. Mixtral — одна из первых открытых моделей на архитектуре «смесь экспертов»; есть версии с картинками (Pixtral, Medium 3.5), для доказательств в Lean и модерации (Shieldstral).

  • Быстрые ответы в чате
  • Извлечение данных из текста
  • Перевод и работа с несколькими языками
Размеры
3B – 675B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

EXAONE

LG AI Research · Южная Корея

Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.

  • Корпоративный ассистент
  • Работа с корейскими и английскими текстами
  • Разбор документов и картинок (4.5)
Размеры
1.2B – 750B-A37B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2026

Solar

Upstage · Южная Корея

Модели корейской Upstage. Solar Open 2 рассчитана на офисную работу с документами: 250 млрд параметров, из них активны 15 млрд, языки — английский, корейский, японский.

  • Работа с офисными документами
  • Агенты для рутинных задач
  • Помощь программистам
Размеры
10.7B – 250B-A15B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

Gemma

Google · США

Компактные модели Google: хорошо работают на одном компьютере, старшие версии понимают картинки. Есть CodeGemma для кода, FunctionGemma 270M для вызова функций и быстрая DiffusionGemma.

  • Ассистент на ноутбуке без интернета
  • Разбор фото документов и чеков
  • Классификация обращений
Размеры
270M – 31B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2025–2026

OpenThinker

Open Thoughts (Стэнфорд, Беркли и другие университеты) · США

Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики регламентов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстOllama2024–2026

Moondream

Moondream (M87 Labs) · США

Небольшая и быстрая модель зрения для продуктовых задач: ответы на вопросы, поиск и указание объектов, подписи. Moondream 3.1 — MoE на 9B с 2B активных.

  • Поиск объектов и подсчёт на фото
  • Проверка фото из полевых отчётов
  • Подписи и теги для каталога
Размеры
2B – 9B-A2B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаOllama2023–2026

Meditron

EPFL · Швейцария

Открытые медицинские модели швейцарского EPFL, которые дообучают поверх разных базовых моделей по клиническим руководствам. Не заменяет врача, решения принимает специалист.

  • Ответы персоналу по клиническим руководствам
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
2B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Dolphin

Cognitive Computations (Эрик Хартфорд) · США

Дообучения без встроенной цензуры поверх Llama, Mistral, Qwen и других: модель выполняет почти любые запросы. Ответственность за фильтрацию и модерацию полностью на том, кто её внедряет, — без своего фильтра клиентам её не показывать.

  • Ассистент, который не отказывает в законных, но «острых» темах
  • Внутренние инструменты под жёстким системным промптом
  • Ролевые и творческие сценарии
Размеры
0.5B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Картинка + текстOllama2023–2026

LLaVA

LLaVA / LMMs-Lab (исследователи из США и Китая) · США / Китай

Открытый проект, с которого пошла мода на модели «картинка + текст». Линейка OneVision понимает фото, документы и видео; открыты данные и рецепты обучения.

  • Ответы на вопросы по фото и скриншотам
  • Описание товаров по фотографии
  • Разбор видео по кадрам
Размеры
0.5B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстOllama2024–2026

MiniCPM-V

OpenBMB (ModelBest и Университет Цинхуа) · Китай

Компактные модели зрения, которые работают даже на телефоне и ноутбуке. Хорошо читают текст на фото, понимают видео; версия 4.6 весит всего 1.3B.

  • Распознавание текста на фото прямо на устройстве
  • Разбор чеков и документов без отправки в облако
  • Описание фото и видео
Размеры
1.3B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2026

Granite Embedding

IBM · США

Лёгкие эмбеддинги IBM для корпоративного поиска, обученные на данных с понятными правами. R2 2026 года стали многоязычными.

  • Поиск по корпоративным документам
  • RAG на обычном сервере без видеокарты
  • Переранжирование результатов
Размеры
30M – 311M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Модерация и безопасностьOllama2024–2026

Granite Guardian

IBM · США

Модели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.

  • Проверка запросов и ответов бота
  • Поиск выдуманных фактов в ответах по базе знаний
  • Проверка своих правил, заданных текстом
Размеры
38M – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстOllama2025–2026

Granite Vision

IBM · США

Компактные модели IBM для корпоративных документов: таблицы, графики, формы, пары «поле — значение». Карточка честно предупреждает, что лучше всего работает с английским.

  • Извлечение полей из форм и счетов
  • Перевод графиков и таблиц в данные
  • Ответы на вопросы по документам
Размеры
2B – 4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаOllama2024–2026

NuExtract

NuMind · Франция

Модели для извлечения данных по шаблону: даёте документ или скан и JSON-шаблон полей, получаете заполненный JSON. NuExtract3 (4B) заодно переводит сканы в Markdown.

  • Извлечение реквизитов, сумм и дат из счетов и договоров в JSON
  • Разбор чеков, накладных и анкет по заданному шаблону
  • Перевод сканов в Markdown для поиска
Размеры
0.5B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2025–2026

Rnj-1

Essential AI · США

Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.

  • Генерация и исправление кода
  • Агент-разработчик на одной видеокарте
  • Решение технических и научных задач
Размеры
8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2024–2026

Qwen Coder

Alibaba (команда Qwen) · Китай

Самая широкая открытая линейка для кода: от 0.5B для автодополнения до 480B для агентов. Qwen3-Coder-Next (80B, активны 3B) работает как агент-разработчик на одной видеокарте.

  • Автодополнение кода в редакторе
  • Агент, который сам правит код в репозитории
  • Генерация и доработка скриптов, SQL, интеграций
Размеры
0.5B – 480B-A35B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаOllama2025–2026

MedGemma

Google · США

Медицинская версия Gemma от Google: читает медицинские тексты и снимки (рентген, дерматология, гистология). Инструмент для врача и разработчика, не заменяет врача, решения принимает специалист.

  • Черновики выписок и заключений для проверки врачом
  • Подсказки при разборе снимков для врача
  • Поиск и пересказ медицинской литературы
Размеры
4B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGRUOllama2025–2026

Qwen3 Embedding / Reranker

Alibaba (Qwen) · Китай

Эмбеддинги и реранкеры на базе Qwen3, в числе лучших открытых для многоязычного поиска, включая русский. VL-версии ищут по картинкам, скриншотам и видео.

  • Поиск по базе знаний для RAG
  • Переранжирование найденного перед ответом
  • Поиск по сканам, слайдам и скриншотам
Размеры
0.6B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Falcon

Technology Innovation Institute (TII) · ОАЭ

Семейство из Абу-Даби: от ранних Falcon 40B и 180B до гибридных Falcon-H1 и сверхмалых Falcon-H1-Tiny на 90–600M параметров для устройств.

  • Ассистент и ответы по документам
  • Работа на слабом железе и в устройствах
  • Вызов инструментов в простых агентах
Размеры
90M – 180B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Phi

Microsoft · США

Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.

  • Ассистент на ноутбуке или своём сервере
  • Задачи с рассуждением и расчётами
  • Разбор изображений и схем (vision-версии)
Размеры
1.3B – 42B-A6.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2024–2026

OLMo

Allen Institute for AI (Ai2) · США

Полностью открытые модели: опубликованы не только веса, но и данные, код обучения и промежуточные снимки. Удобно, когда важна прозрачность происхождения.

  • Ассистент и ответы по документам
  • Задачи с рассуждением (версии Think)
  • Дообучение под свои данные с понятной историей модели
Размеры
1B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRUOllama2026

TranslateGemma

Google · США

Переводчики на базе Gemma 3 на 55 языков, умеют переводить и текст на картинках. Русский есть. Версия 4B помещается на ноутбук.

  • Перевод документов и переписки
  • Перевод текста со скриншотов и фото
  • Локализация сайтов и приложений
Размеры
4B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Документы и OCROllama2025–2026

DeepSeek-OCR

DeepSeek · Китай

OCR-модель, которая сильно сжимает страницу в небольшое число визуальных токенов, поэтому быстро обрабатывает большие объёмы. Версия 2 лучше понимает порядок чтения.

  • Массовое распознавание сканов счетов и договоров
  • Распознавание таблиц
  • Перевод PDF в Markdown для поиска и RAG
Размеры
около 3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Документы и OCRRUOllama2026

GLM-OCR

Zhipu AI (Z.ai) · Китай

Лёгкая OCR-модель Zhipu для разбора документов. В карточке русский указан среди поддерживаемых языков; рассчитана на высокую нагрузку и слабое железо.

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Распознавание таблиц и формул
  • Извлечение полей в JSON
Размеры
0.9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодRUOllama2025

Devstral

Mistral AI (с All Hands AI) · Франция

Модели Mistral для агентной разработки: сами читают репозиторий, правят файлы и запускают команды. Версия 24B помещается на одну видеокарту.

  • Агент-разработчик для исправления задач из трекера
  • Доработка внутренних систем по описанию
  • Автоматизация рутинных правок в коде
Размеры
24B – 123B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllama2023–2025

Hermes

Nous Research · США

Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.

  • Агенты, вызывающие функции и API
  • Извлечение данных в строгом формате JSON
  • Ассистент с гибкой настройкой роли и тона
Размеры
3B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2025

Cogito

Deep Cogito · США

Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.

  • Чат-ассистент с режимом рассуждений
  • Написание кода и вызов инструментов
  • Ответы на сложные вопросы по документам
Размеры
3B – 671B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Модерация и безопасностьOllama2025

gpt-oss-safeguard

OpenAI · США

Модерация по вашим правилам: политику пишете обычным текстом, модель рассуждает и выносит решение с объяснением. Построена на gpt-oss.

  • Модерация по внутренним правилам компании
  • Разметка спорных сообщений с объяснением
  • Проверка отзывов и объявлений перед публикацией
Размеры
20B – 120B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Картинка + текстOllama2023–2025

Qwen-VL

Alibaba (команда Qwen) · Китай

Одна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.

  • Извлечение данных из сканов счетов и накладных
  • Разбор фотографий товаров и витрин
  • Анализ видео и записей с камер
Размеры
2B – 235B-A22B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2025

mxbai (Mixedbread Embed и Rerank)

Mixedbread · Германия

Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.

  • Поиск по базе знаний
  • Переранжирование результатов перед ответом бота
  • Поиск по каталогу товаров
Размеры
17M – 1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGOllama2025

EmbeddingGemma

Google · США

Маленькая многоязычная модель эмбеддингов на базе Gemma 3, работает даже на телефоне и ноутбуке без интернета.

  • Поиск по документам на устройстве
  • RAG без отправки данных наружу
  • Классификация текстов
Размеры
300M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGOllama2023–2025

BGE (BAAI General Embedding)

BAAI (Пекинская академия ИИ) · Китай

Одни из самых популярных эмбеддингов для поиска и RAG. Основные версии v1.5 рассчитаны на английский и китайский; для русского у BAAI есть отдельная bge-m3.

  • Поиск по документам на английском
  • Подбор фрагментов для ответа чат-бота (RAG)
  • Поиск по коду (bge-code)
Размеры
24M – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2025

gpt-oss

OpenAI · США

Первые открытые модели OpenAI со времён GPT-2. Рассуждения, вызов инструментов, младшая версия помещается на одну видеокарту.

  • ИИ-агент с вызовом внутренних систем
  • Ответы по регламентам
  • Черновики писем и отчётов
Размеры
20B, 120B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRUOllama2024–2025

SmolLM

Hugging Face · США

Крошечные открытые модели Hugging Face для телефонов и ноутбуков. SmolLM3 на 3B умеет рассуждать и держит длинный контекст, весь рецепт обучения открыт.

  • Простой ассистент прямо на устройстве
  • Классификация и маршрутизация обращений
  • Основа для дообучения под узкую задачу
Размеры
135M – 3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2025

DeepScaleR, DeepCoder, DeepSWE

Agentica (Беркли, Sky Computing Lab) и Together AI · США

Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.

  • Решение математических задач с пошаговым выводом
  • Генерация и проверка кода
  • Агент для исправления ошибок в репозитории
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2025

DeepSeek-R1

DeepSeek · Китай

Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.

  • Сложные расчёты и проверка логики
  • Анализ договоров и регламентов
  • Помощь программистам
Размеры
1,5B – 671B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2025

Llama

Meta · США

Модели, с которых начался массовый open source в ИИ. Огромная экосистема дообученных версий и инструментов.

  • Ассистент для сотрудников
  • Суммаризация встреч и документов
  • Основа для дообучения под отрасль
Размеры
1B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Модерация и безопасностьOllama2023–2025

Llama Guard

Meta · США

Модели-фильтры, которые проверяют запросы к чат-боту и его ответы на опасные темы по списку категорий. Версия 4 проверяет и картинки. Русский официально не заявлен.

  • Проверка вопросов пользователей к боту
  • Проверка ответов бота перед отправкой
  • Отчёт, какая категория правил нарушена
Размеры
1B – 12B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияOllama2024–2025

QwQ

Qwen (Alibaba) · Китай

Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики договоров и регламентов
Размеры
32B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2025

Nomic Embed

Nomic AI · США

Полностью открытые эмбеддинги — с весами, данными и кодом обучения. v2 многоязычная на MoE, есть версии для кода и для поиска по PDF-страницам.

  • Поиск по документам и базе знаний
  • Поиск по коду
  • Поиск по сканам и PDF без распознавания
Размеры
137M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Модерация и безопасностьOllama2024–2025

ShieldGemma

Google · США

Фильтры на базе Gemma: проверяют текст на опасный и оскорбительный контент, а ShieldGemma 2 проверяет картинки. Ориентированы на английский.

  • Модерация сообщений пользователей
  • Проверка ответов бота
  • Проверка сгенерированных картинок перед публикацией
Размеры
2B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2025

Tulu

Ai2 · США

Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.

  • Ассистент для сотрудников на своём сервере
  • Математика и точное следование инструкциям
  • Образец рецепта для собственного дообучения
Размеры
7B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияOllama2024–2025

Qwen2.5-Math

Qwen (Alibaba) · Китай

Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.

  • Расчёты и проверка формул
  • Проверка расчётов в сметах и отчётах
  • Разбор задач по шагам
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGRUOllama2019–2025

Sentence Transformers (all-MiniLM, paraphrase-multilingual)

UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия

Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.

  • Поиск по базе знаний и FAQ
  • Поиск похожих обращений и дублей
  • Группировка отзывов и заявок по темам
Размеры
около 20M – 470M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUOllama2024–2025

ReaderLM (Jina)

Jina AI · Германия

Маленькие модели, которые превращают сырой HTML веб-страниц в чистый Markdown или JSON. Удобно готовить сайты для базы знаний. Лицензия только некоммерческая.

  • Очистка страниц сайтов для базы знаний
  • Извлечение данных со страниц в JSON
  • Подготовка текстов для RAG
Размеры
0.5B – 1.5B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Поиск и RAGRUOllama2024

Snowflake Arctic Embed

Snowflake · США

Эмбеддинги от Snowflake, заточенные именно под поиск. Версия 2.0 многоязычная (русский в списке языков), держит длинные тексты до 8 тыс. токенов и умеет сжимать векторы.

  • Поиск по документам и базе знаний
  • Подбор фрагментов для RAG
  • Поиск по отчётам и внутренним данным
Размеры
22M – 568M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2024

OpenCoder

INF Technology · Китай

Полностью воспроизводимые модели для кода: вместе с весами открыты данные, конвейер их очистки и рецепт обучения. Понимают английский и китайский.

  • Генерация и дополнение кода
  • Обучение своей модели для кода по открытому рецепту
  • Ассистент программиста на слабом железе
Размеры
1.5B – 8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024

Athene

Nexusflow · США

Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.

  • Исследование агентов и вызова функций
  • Сравнение с коммерческими моделями
  • Эксперименты с чат-ассистентом
Размеры
70B – 72B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
КодOllama2023–2024

DeepSeek-Coder

DeepSeek · Китай

Линейка моделей для кода от DeepSeek: от маленьких для автодополнения до большой MoE V2, которая в 2024 году была на уровне закрытых моделей. Позже код ушёл в общие модели DeepSeek.

  • Автодополнение и генерация кода
  • Перевод кода между языками
  • Поиск ошибок и объяснение чужого кода
Размеры
1.3B – 236B-A21B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КодOllama2024

Yi-Coder

01.AI · Китай

Модели для кода от 01.AI на 1.5B и 9B с контекстом 128 тыс. токенов и поддержкой 52 языков программирования. Отдельная линейка рядом с текстовыми Yi.

  • Автодополнение и генерация кода
  • Объяснение и рефакторинг кода
  • Ассистент программиста без облака
Размеры
1.5B – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответовOllamaНе развивается2024

MiniCheck

UT Austin и Bespoke Labs · США

Проверяет, подтверждается ли каждое утверждение в ответе ИИ исходными документами. Малые версии свободные, старшая 7B есть в Ollama, но некоммерческая.

  • Проверка ответов RAG-бота по документам
  • Поиск неподтверждённых утверждений в отчётах и пересказах
  • Автоматический контроль качества ИИ-ответов
Размеры
0.4B – 7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

StableLM и Stable Code

Stability AI · Великобритания

Малые модели Stability AI: StableLM 2 на 1.6B знает 7 европейских языков, Stable Code на 3B дописывает код. Обновлений с 2024 года нет.

  • Лёгкий чат-бот на обычном ПК
  • Автодополнение кода в редакторе
  • Основа для дообучения под свою задачу
Размеры
1.6B – 12B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КодOllamaНе развивается2024

Codestral

Mistral AI · Франция

Модель Mistral для кода на 80+ языках программирования. Открытые веса основной версии нельзя использовать в работе без платной лицензии; новые версии Codestral только по API.

  • Оценка и тесты перед покупкой лицензии
  • Автодополнение кода (при коммерческой лицензии)
  • Исследование качества моделей для кода
Размеры
7B – 22B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
КодOllamaНе развивается2023–2024

CodeGeeX

Zhipu AI (Z.ai) и Университет Цинхуа · Китай

Модели для кода от создателей GLM. CodeGeeX4-ALL-9B на базе GLM-4-9B в одной модели совмещает автодополнение, чат по коду, вызов функций и поиск по репозиторию.

  • Автодополнение кода в IDE
  • Чат-помощник по коду
  • Ответы на вопросы по репозиторию
Размеры
6B – 9B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

OpenChat

OpenChat (Университет Цинхуа) · Китай

Дообучения Mistral 7B и Llama 3 8B по методу C-RLFT, которые в 2023–2024 годах догоняли ChatGPT-3.5 при размере 7–8B. Лёгкий универсальный ассистент для слабого сервера.

  • Чат-ассистент на недорогом сервере
  • Черновики писем и ответов
  • Помощь с простым кодом
Размеры
7B – 13B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

Yi

01.AI · Китай

Двуязычные (английский и китайский) модели 01.AI на 6–34B с версиями на контекст до 200 тыс. токенов. Новых открытых выпусков с 2024 года нет.

  • Чат-ассистент на одной видеокарте
  • Разбор длинных документов
  • Классификация и извлечение данных из текста
Размеры
6B – 34B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLOllamaНе развивается2023–2024

SQLCoder

Defog · США

Одна из первых открытых моделей, которые переводят вопрос на обычном языке в SQL-запрос к базе. Есть в Ollama, но свежие конкуренты уже сильнее.

  • Ответы на вопросы менеджеров по базе продаж без аналитика
  • Черновики SQL-запросов для отчётов
  • Помощник внутри BI-системы
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КодOllamaНе развивается2023–2024

StarCoder

BigCode (Hugging Face и ServiceNow) · США / Франция

Одна из первых открытых моделей для кода, обучена на открытом наборе исходников с возможностью исключить свой репозиторий. Сегодня скорее база для дообучения, чем лидер.

  • Автодополнение кода в редакторе
  • Дообучение на внутреннем коде компании
  • Генерация шаблонного кода и тестов
Размеры
1B – 15B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

Zephyr

Hugging Face (H4) · США

Учебные чат-модели Hugging Face на базе Mistral, Gemma и Mixtral с открытым рецептом дообучения. Zephyr 7B Beta показал, что маленькую модель можно «воспитать» до уровня крупных без ручной разметки людьми.

  • Лёгкий чат-ассистент
  • Образец и отправная точка для своего дообучения
  • Черновики текстов и ответов
Размеры
7B – 141B-A35B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023–2024

TinyLlama

TinyLlama (исследователи SUTD) · Сингапур

Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.

  • Простые чат-боты на слабом железе
  • Эксперименты и обучение команды
  • Основа для дообучения под узкую задачу
Размеры
1.1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllamaНе развивается2024

BGE-M3

BAAI · Китай

Модель для поиска по смыслу на сотне языков. Основа RAG: бот находит нужный кусок документа перед ответом.

  • Поиск по базе документов
  • RAG для чат-бота
  • Поиск похожих обращений и дублей
Размеры
568M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllamaНе развивается2023–2024

Code Llama

Meta · США

Версия Llama 2, доученная на коде; есть варианты для Python и для диалога. Устарела, но много готовых дообученных версий и инструментов.

  • Автодополнение и объяснение кода
  • Генерация скриптов на Python
  • Базовая модель для дообучения под свой стек
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

WizardLM, WizardCoder, WizardMath

WizardLM (Microsoft и Пекинский университет) · США / Китай

Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.

  • Сложные многошаговые инструкции
  • Помощь программистам
  • Решение математических задач
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст в SQLOllamaНе развивается2024

DuckDB-NSQL

MotherDuck и Numbers Station · США

Модель для перевода вопросов в SQL, заточенная под встраиваемую аналитическую базу DuckDB. Есть в Ollama, удобна для локальной работы с CSV и Parquet.

  • Вопросы к выгрузкам CSV и Parquet на обычном языке
  • Запросы к DuckDB внутри аналитических скриптов
  • Быстрая аналитика на ноутбуке без сервера
Размеры
7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023

NeuralChat

Intel · США

Дообученная Mistral 7B от Intel, показывавшая обучение и запуск на процессорах и ускорителях Intel. Устарела, интересна как пример оптимизации под железо Intel.

  • Простой чат-ассистент
  • Эксперименты с запуском на железе Intel
  • Основа для дообучения
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023

Orca 2

Microsoft Research · США

Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.

  • Исследования методов рассуждения
  • Сравнение с современными малыми моделями
  • Обучение специалистов
Размеры
7B – 13B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ТекстOllamaНе развивается2023

Vicuna

LMSYS (Беркли и партнёры) · США

Одна из первых открытых чат-моделей 2023 года: LLaMA, дообученная на диалогах пользователей ChatGPT. Историческая веха, сегодня уступает любой современной модели того же размера.

  • Эксперименты и обучение команды
  • Простой чат-ассистент для тестов
  • Сравнение с новыми моделями
Размеры
7B – 33B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение