Текст2024–2026
MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ
Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.
- Рассуждения, математика и технические вопросы
- Разбор длинных документов
- Агенты и написание кода
- Размеры
- 0.9B – 375B-A23B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025–2026
Open Thoughts (Стэнфорд, Беркли и другие университеты) · США
Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики регламентов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
ServiceNow · США
Модели ServiceNow на 15B с пошаговыми рассуждениями, которые помещаются на одну видеокарту. С версии 1.5 понимают и картинки, хорошо вызывают инструменты.
- Ассистент с рассуждениями для внутренних сервисов
- Вызов инструментов и корпоративные агенты
- Разбор скриншотов и документов с картинками
- Размеры
- 5B – 15B
- Железо
- от: Ноутбук
КодOllama2025–2026
Essential AI · США
Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.
- Генерация и исправление кода
- Агент-разработчик на одной видеокарте
- Решение технических и научных задач
- Размеры
- 8B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025–2026
Принстонский университет · США
Открытые модели для формальных доказательств в Lean 4 из Принстона. Свежая Goedel-Code-Prover доказывает корректность программ.
- Формальная проверка математических выкладок
- Проверка корректности кода
- Обучение
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2026
LM Provers (CMU, Hugging Face, ETH Zurich, Project Numina) · США, Швейцария, Франция
Маленькая модель 4B на Qwen3, которая пишет математические доказательства на обычном языке почти на уровне больших моделей. Запускается на ноутбуке.
- Проверка логики рассуждений и выкладок
- Пошаговое объяснение решений
- Обучение и олимпиадная подготовка
- Размеры
- 4B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2024–2025
DeepSeek · Китай
Математические модели DeepSeek. Первая версия 7B ввела метод обучения GRPO, V2 на 685B пишет и сама проверяет доказательства уровня олимпиад.
- Расчёты и проверка формул
- Проверка математических выкладок в отчётах
- Разбор задач по шагам
- Размеры
- 7B – 685B
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Nous Research · США
Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.
- Агенты, вызывающие функции и API
- Извлечение данных в строгом формате JSON
- Ассистент с гибкой настройкой роли и тона
- Размеры
- 3B – 405B
- Железо
- от: Ноутбук
ТекстOllama2025
Deep Cogito · США
Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.
- Чат-ассистент с режимом рассуждений
- Написание кода и вызов инструментов
- Ответы на сложные вопросы по документам
- Размеры
- 3B – 671B
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2025
OpenAI · США
Модерация по вашим правилам: политику пишете обычным текстом, модель рассуждает и выносит решение с объяснением. Построена на gpt-oss.
- Модерация по внутренним правилам компании
- Разметка спорных сообщений с объяснением
- Проверка отзывов и объявлений перед публикацией
- Размеры
- 20B – 120B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Moonshot AI и Project Numina · Китай, Франция
Модели для формальных доказательств в Lean 4 от Moonshot AI (Kimi) и Numina. Есть маленькие версии от 0.6B, которые запускаются на ноутбуке.
- Формальная проверка математических выкладок
- Перевод задачи с обычного языка на Lean
- Обучение и олимпиадная подготовка
- Размеры
- 0.6B – 72B
- Железо
- от: Ноутбук
ТекстRU2024–2025
НИВЦ МГУ, лаборатория LAIR (RefalMachine) · Россия
Модели Qwen, переделанные под русский язык: заменён токенизатор и проведено дообучение на русских текстах. За счёт этого русский текст генерируется до двух раз быстрее, чем у исходной модели того же размера.
- Русскоязычный ассистент на своём сервере
- Ответы по документам компании (RAG) на русском
- Разбор и пересказ длинных русских текстов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
МедицинаGGUF2025
Intelligent Internet · Великобритания
Рассуждающие медицинские модели на Qwen3, которые рассчитаны на запуск на обычном компьютере. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу с ходом рассуждения
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025
Agentica (Беркли, Sky Computing Lab) и Together AI · США
Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.
- Решение математических задач с пошаговым выводом
- Генерация и проверка кода
- Агент для исправления ошибок в репозитории
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассуждения2025
NVIDIA · США
Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Разбор задач по программированию
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Текст в SQLGGUF2025
IDEA Research · Китай
Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.
- Запросы к базе по вопросам с несколькими условиями
- Разбор и исправление чужих SQL-запросов
- Помощник аналитика в BI-системе
- Размеры
- 3B – 14B
- Железо
- от: Ноутбук
Финансы2025
The Fin AI · международный проект
Модели, которые перед ответом проговаривают ход рассуждения по финансовым задачам с числами и таблицами. Не инвестиционная рекомендация: решения принимает специалист.
- Расчётные вопросы по отчётности с показом хода решения
- Разбор задач с таблицами и числами из документов
- Проверка расчётов, сделанных вручную
- Размеры
- 8B и 14B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2024–2025
DeepSeek · Китай
Модели DeepSeek для формальных доказательств на языке Lean 4: доказательство проверяет программа, а не человек. Узкий инструмент для математиков и инженеров.
- Формальная проверка математических выкладок
- Проверка корректности алгоритмов
- Обучение и олимпиадная подготовка
- Размеры
- 7B – 671B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики договоров и регламентов
- Размеры
- 32B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Стэнфордский университет · США
Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.
- Расчёты и проверка формул
- Разбор сложных задач по шагам
- Обучение
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
Qihoo 360 · Китай
Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Финансы2025
Шанхайский университет финансов и экономики (SUFE) · Китай
Модель с рассуждениями для финансовых задач на базе Qwen2.5-7B: расчёты, разбор отчётов, вопросы по регулированию. Обучена на китайских и английских данных.
- Финансовые расчёты с пошаговым объяснением
- Ответы на вопросы по отчётности
- Разбор таблиц с финансовыми данными
- Размеры
- 7B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
NovaSky (Sky Computing Lab, Беркли) · США
Рассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Ai2 · США
Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.
- Ассистент для сотрудников на своём сервере
- Математика и точное следование инструкциям
- Образец рецепта для собственного дообучения
- Размеры
- 7B – 405B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.
- Расчёты и проверка формул
- Проверка расчётов в сметах и отчётах
- Разбор задач по шагам
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
WizardLM (Microsoft и Пекинский университет) · США / Китай
Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.
- Сложные многошаговые инструкции
- Помощь программистам
- Решение математических задач
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
Microsoft Research · США
Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.
- Исследования методов рассуждения
- Сравнение с современными малыми моделями
- Обучение специалистов
- Размеры
- 7B – 13B
- Железо
- от: Ноутбук