Открытые модели для математики и рассуждений

Рассуждающие модели решают задачу по шагам: считают, проверяют промежуточные выводы и справляются со сложной логикой лучше обычных чат-моделей. Их используют для расчётов, аналитики и задач, где важна точность. Учитывайте, что такие ответы дольше и дороже по ресурсам, и проверьте лицензию.

В подборке 27 семейств открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
Текст2024–2026

K2 (K2-Think, K2-V2, K2-Horizon)

MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ

Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.

  • Рассуждения, математика и технические вопросы
  • Разбор длинных документов
  • Агенты и написание кода
Размеры
0.9B – 375B-A23B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2025–2026

OpenThinker

Open Thoughts (Стэнфорд, Беркли и другие университеты) · США

Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики регламентов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

Apriel

ServiceNow · США

Модели ServiceNow на 15B с пошаговыми рассуждениями, которые помещаются на одну видеокарту. С версии 1.5 понимают и картинки, хорошо вызывают инструменты.

  • Ассистент с рассуждениями для внутренних сервисов
  • Вызов инструментов и корпоративные агенты
  • Разбор скриншотов и документов с картинками
Размеры
5B – 15B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2025–2026

Rnj-1

Essential AI · США

Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.

  • Генерация и исправление кода
  • Агент-разработчик на одной видеокарте
  • Решение технических и научных задач
Размеры
8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025–2026

Goedel-Prover

Принстонский университет · США

Открытые модели для формальных доказательств в Lean 4 из Принстона. Свежая Goedel-Code-Prover доказывает корректность программ.

  • Формальная проверка математических выкладок
  • Проверка корректности кода
  • Обучение
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2026

QED-Nano

LM Provers (CMU, Hugging Face, ETH Zurich, Project Numina) · США, Швейцария, Франция

Маленькая модель 4B на Qwen3, которая пишет математические доказательства на обычном языке почти на уровне больших моделей. Запускается на ноутбуке.

  • Проверка логики рассуждений и выкладок
  • Пошаговое объяснение решений
  • Обучение и олимпиадная подготовка
Размеры
4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2024–2025

DeepSeek-Math

DeepSeek · Китай

Математические модели DeepSeek. Первая версия 7B ввела метод обучения GRPO, V2 на 685B пишет и сама проверяет доказательства уровня олимпиад.

  • Расчёты и проверка формул
  • Проверка математических выкладок в отчётах
  • Разбор задач по шагам
Размеры
7B – 685B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2025

Hermes

Nous Research · США

Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.

  • Агенты, вызывающие функции и API
  • Извлечение данных в строгом формате JSON
  • Ассистент с гибкой настройкой роли и тона
Размеры
3B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2025

Cogito

Deep Cogito · США

Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.

  • Чат-ассистент с режимом рассуждений
  • Написание кода и вызов инструментов
  • Ответы на сложные вопросы по документам
Размеры
3B – 671B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Модерация и безопасностьOllama2025

gpt-oss-safeguard

OpenAI · США

Модерация по вашим правилам: политику пишете обычным текстом, модель рассуждает и выносит решение с объяснением. Построена на gpt-oss.

  • Модерация по внутренним правилам компании
  • Разметка спорных сообщений с объяснением
  • Проверка отзывов и объявлений перед публикацией
Размеры
20B – 120B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Kimina-Prover

Moonshot AI и Project Numina · Китай, Франция

Модели для формальных доказательств в Lean 4 от Moonshot AI (Kimi) и Numina. Есть маленькие версии от 0.6B, которые запускаются на ноутбуке.

  • Формальная проверка математических выкладок
  • Перевод задачи с обычного языка на Lean
  • Обучение и олимпиадная подготовка
Размеры
0.6B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024–2025

Ruadapt (RuadaptQwen)

НИВЦ МГУ, лаборатория LAIR (RefalMachine) · Россия

Модели Qwen, переделанные под русский язык: заменён токенизатор и проведено дообучение на русских текстах. За счёт этого русский текст генерируется до двух раз быстрее, чем у исходной модели того же размера.

  • Русскоязычный ассистент на своём сервере
  • Ответы по документам компании (RAG) на русском
  • Разбор и пересказ длинных русских текстов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаGGUF2025

II-Medical

Intelligent Internet · Великобритания

Рассуждающие медицинские модели на Qwen3, которые рассчитаны на запуск на обычном компьютере. Не заменяет врача, решения принимает специалист.

  • Справочные ответы персоналу с ходом рассуждения
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2025

DeepScaleR, DeepCoder, DeepSWE

Agentica (Беркли, Sky Computing Lab) и Together AI · США

Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.

  • Решение математических задач с пошаговым выводом
  • Генерация и проверка кода
  • Агент для исправления ошибок в репозитории
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассуждения2025

AceMath / AceReason

NVIDIA · США

Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Разбор задач по программированию
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст в SQLGGUF2025

SQL-R1

IDEA Research · Китай

Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.

  • Запросы к базе по вопросам с несколькими условиями
  • Разбор и исправление чужих SQL-запросов
  • Помощник аналитика в BI-системе
Размеры
3B – 14B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Финансы2025

Fino1 / Fin-o1

The Fin AI · международный проект

Модели, которые перед ответом проговаривают ход рассуждения по финансовым задачам с числами и таблицами. Не инвестиционная рекомендация: решения принимает специалист.

  • Расчётные вопросы по отчётности с показом хода решения
  • Разбор задач с таблицами и числами из документов
  • Проверка расчётов, сделанных вручную
Размеры
8B и 14B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Математика и рассужденияGGUF2024–2025

DeepSeek-Prover

DeepSeek · Китай

Модели DeepSeek для формальных доказательств на языке Lean 4: доказательство проверяет программа, а не человек. Узкий инструмент для математиков и инженеров.

  • Формальная проверка математических выкладок
  • Проверка корректности алгоритмов
  • Обучение и олимпиадная подготовка
Размеры
7B – 671B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияOllama2024–2025

QwQ

Qwen (Alibaba) · Китай

Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики договоров и регламентов
Размеры
32B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

s1

Стэнфордский университет · США

Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.

  • Расчёты и проверка формул
  • Разбор сложных задач по шагам
  • Обучение
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Light-R1

Qihoo 360 · Китай

Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.

  • Расчёты и проверка формул
  • Разбор задач по шагам
  • Основа для своего дообучения рассуждениям
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Финансы2025

Fin-R1

Шанхайский университет финансов и экономики (SUFE) · Китай

Модель с рассуждениями для финансовых задач на базе Qwen2.5-7B: расчёты, разбор отчётов, вопросы по регулированию. Обучена на китайских и английских данных.

  • Финансовые расчёты с пошаговым объяснением
  • Ответы на вопросы по отчётности
  • Разбор таблиц с финансовыми данными
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Sky-T1

NovaSky (Sky Computing Lab, Беркли) · США

Рассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.

  • Расчёты и проверка формул
  • Разбор задач по шагам
  • Основа для своего дообучения рассуждениям
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2025

Tulu

Ai2 · США

Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.

  • Ассистент для сотрудников на своём сервере
  • Математика и точное следование инструкциям
  • Образец рецепта для собственного дообучения
Размеры
7B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияOllama2024–2025

Qwen2.5-Math

Qwen (Alibaba) · Китай

Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.

  • Расчёты и проверка формул
  • Проверка расчётов в сметах и отчётах
  • Разбор задач по шагам
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

WizardLM, WizardCoder, WizardMath

WizardLM (Microsoft и Пекинский университет) · США / Китай

Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.

  • Сложные многошаговые инструкции
  • Помощь программистам
  • Решение математических задач
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023

Orca 2

Microsoft Research · США

Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.

  • Исследования методов рассуждения
  • Сравнение с современными малыми моделями
  • Обучение специалистов
Размеры
7B – 13B
Железо
от: Ноутбук
Только некоммерческоеПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение