Открытые языковые модели для бизнеса

Языковые модели пишут и правят тексты, отвечают клиентам, делают выжимки из документов и становятся основой для чат-ботов и ассистентов. Открытую модель можно развернуть у себя, и данные не уйдут к стороннему сервису. При выборе смотрите, насколько хорошо модель понимает русский, разрешает ли лицензия коммерческое использование и какой размер потянет ваше железо.

В подборке 118 семейств открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
МедицинаGGUF2023–2026

HuatuoGPT

FreedomIntelligence (Китайский университет Гонконга, Шэньчжэнь) · Китай

Большое семейство медицинских моделей: чат, версия со снимками, рассуждающая HuatuoGPT-o1 и новая HuatuoGPT-3 на Qwen3. Не заменяет врача, решения принимает специалист.

  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
  • Подсказки при разборе снимков для врача (Vision)
Размеры
7B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2026

DeepSeek

DeepSeek · Китай

Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.

  • Ассистент для сотрудников на своём сервере
  • Разбор длинных договоров и отчётов
  • Агенты, которые работают с инструментами и API
Размеры
7B – 1.6T-A49B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2026

InternLM / Intern-S

Shanghai AI Laboratory · Китай

Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.

  • Помощник исследователя: статьи, формулы, данные
  • Разбор научных и технических документов
  • Корпоративный чат на малых моделях
Размеры
1.8B – около 1T
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

MiMo

Xiaomi · Китай

Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.

  • Логические и расчётные задачи
  • Агенты с инструментами
  • Помощь программистам
Размеры
7B – 1,02T-A42B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024–2026

GigaChat

Сбер · Россия

Открытые модели Сбера, обученные с упором на русский язык: хорошо пишут и понимают по-русски, знают местные реалии. Есть лёгкая 10B-A1.8B и флагманы до 702B, всё под MIT. GigaChat3.1-Audio понимает звук и записи до двух часов, GFusion — быстрая диффузионная версия для текста.

  • Русскоязычный ассистент для сотрудников на своём сервере
  • Ответы клиентам и разбор обращений на русском
  • Работа с договорами и внутренними регламентами
Размеры
10B-A1.8B – 702B-A36B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2022–2026

YandexGPT / AliceAI

Яндекс · Россия

Модели Яндекса, обученные с нуля с упором на русский язык и российские реалии. Новая AliceAI-Foundation 80B-A3B (Apache 2.0) — только базовая модель, инструкт-версии нет: её дообучают под свои задачи. Рядом экономичная AliceAI-T5 35B-A0.6B.

  • Русскоязычный ассистент и чат-бот
  • Ответы на вопросы по базе знаний компании
  • Основа для дообучения под свою отрасль
Размеры
8B – 100B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2024–2026

Aya

Cohere Labs · Канада

Многоязычные модели исследовательского крыла Cohere, от 23 до 100+ языков. Tiny Aya 2026 года на 3.3B работает на обычном ПК, но только некоммерчески.

  • Перевод и переписка на редких языках
  • Многоязычный чат-ассистент
  • Разбор изображений с текстом (Vision)
Размеры
3.3B – 35B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2024–2026

MiniCPM

OpenBMB (ModelBest и Университет Цинхуа) · Китай

Компактные текстовые модели для работы прямо на устройстве: ноутбуке, телефоне, мини-ПК. MiniCPM5 на 1B и 2B ориентированы на вызов инструментов и длинный контекст.

  • Локальный чат-ассистент без облака
  • Извлечение данных и классификация текстов
  • Вызов инструментов и простые агенты на слабом железе
Размеры
0.5B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст2024–2026

K2 (K2-Think, K2-V2, K2-Horizon)

MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ

Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.

  • Рассуждения, математика и технические вопросы
  • Разбор длинных документов
  • Агенты и написание кода
Размеры
0.9B – 375B-A23B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

LLaDA

Жэньминьский университет (GSAI) и Ant Group (inclusionAI) · Китай

Диффузионные языковые модели: текст пишется не по одному слову, а сразу блоками с последующим уточнением, что ускоряет генерацию. LLaDA2.2 умеет править уже написанное и рассчитана на агентов. Генератор картинок LLaDA-Image — отдельный продукт.

  • Быстрая генерация кода и текстов
  • Агентные сценарии с длинным контекстом
  • Исследования альтернатив обычным LLM
Размеры
8B – 100B (MoE)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRU2026

Zarya (ai-forever)

SberDevices (ai-forever) · Россия

Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.

  • Эксперименты с ускорением генерации
  • Дообучение небольших моделей под свои задачи
  • Исследования
Размеры
0.6B – 4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Qwen

Alibaba · Китай

Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.

  • Чат-бот и ассистент по базе знаний
  • Ответы на письма и обращения
  • Разбор и классификация документов
Размеры
0,6B – 2,4T-A95B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2026

GLM (ChatGLM)

Zhipu AI (Z.ai) · Китай

Одна из старейших китайских открытых линий: от ChatGLM-6B до GLM-5.3. Сильна в агентных задачах и программировании; GLM-5.3-Flash понимает картинки и выходит под MIT.

  • Корпоративный чат-ассистент
  • Агенты для рутинных офисных задач
  • Помощь программистам
Размеры
1.5B – 744B-A40B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2024–2026

Hunyuan / Hy

Tencent · Китай

Языковые модели Tencent: от малых 0.5B–7B до Hy4-preview на 770 млрд параметров. С 2026 года линия переименована в Hy, а новые версии вышли под Apache 2.0.

  • Корпоративный ассистент
  • Перевод и работа с многоязычными текстами
  • Агенты с инструментами
Размеры
0.5B – 770B-A49B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2025–2026

Ling / Ring

Ant Group (inclusionAI) · Китай

Семейство Ant Group: Ling — обычные модели, Ring — рассуждающие. Есть и триллионные флагманы, и экономичная Ling-3.0-tiny, которой хватает 1,3 млрд активных параметров.

  • Корпоративный ассистент
  • Агенты для офисных процессов
  • Финансовая аналитика (есть версия Fin)
Размеры
7.9B-A1.3B – 1T
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2024–2026

Cohere Command

Cohere · Канада

Модели для бизнеса: поиск по документам со ссылками на источники, вызов инструментов, много языков. Command A+ 2026 года впервые вышла под Apache 2.0, за ней — линейка North: код, перевод и компактное зрение.

  • Ответы по базе знаний со ссылками на источники
  • Агенты, работающие с внутренними системами
  • Перевод и переписка на разных языках
Размеры
2.5B – 218B-A25B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

NVIDIA Nemotron

NVIDIA · США

Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).

  • Агенты с вызовом инструментов
  • Задачи с рассуждением и расчётами
  • Ответы по длинным документам
Размеры
4B – 550B-A55B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

IBM Granite

IBM · США

Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.

  • Ответы по внутренним документам (RAG)
  • Вызов инструментов и работа в агентах
  • Извлечение данных и классификация
Размеры
350M – 34B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2025–2026

Liquid LFM

Liquid AI · США

Модели новой архитектуры для работы прямо на устройстве: быстрые на обычном процессоре и в телефоне. Есть версии для извлечения данных, RAG и инструментов, а также LFM2.5-VL для картинок и голосовая LFM2.5-Audio.

  • Ассистент на ноутбуке или телефоне без интернета
  • Извлечение данных из документов
  • Вызов инструментов в приложениях
Размеры
230M – 24B-A2B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2026

Muse Glimmer

Meta Superintelligence Labs · США

Открытая модель Meta для агентов на доступном железе: дистиллирована из закрытой Muse Spark, понимает текст и картинки, обучена на 100+ языках.

  • Агенты с вызовом инструментов
  • Разбор скриншотов, графиков и документов
  • Многоязычный ассистент
Размеры
30B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Mistral

Mistral AI · Франция

Европейские модели с упором на скорость. Mixtral — одна из первых открытых моделей на архитектуре «смесь экспертов»; есть версии с картинками (Pixtral, Medium 3.5), для доказательств в Lean и модерации (Shieldstral).

  • Быстрые ответы в чате
  • Извлечение данных из текста
  • Перевод и работа с несколькими языками
Размеры
3B – 675B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

Kimi

Moonshot AI · Китай

Сверхкрупные MoE-модели Moonshot для агентной работы. K3 на 2,8 трлн параметров — самая большая открытая модель на момент выхода, с контекстом до 1 млн токенов и пониманием картинок; K2.7-Code заточена под программирование.

  • Многошаговые агенты: поиск, сбор данных, отчёты
  • Глубокий анализ документов
  • Помощь программистам
Размеры
16B-A3B – 2.8T-A104B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

LongCat

Meituan · Китай

Модели Meituan (крупнейший сервис доставки Китая). LongCat-Flash динамически меняет объём вычислений под сложность запроса; LongCat-2.0 — 1,6 трлн параметров под MIT. Есть омни-модели (Flash-Omni, Next) и синтез речи AudioDiT.

  • Агенты для заказов и сервисных процессов
  • Корпоративный ассистент
  • Разбор длинных документов
Размеры
1B – 1.6T-A48B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2024–2026

EXAONE

LG AI Research · Южная Корея

Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.

  • Корпоративный ассистент
  • Работа с корейскими и английскими текстами
  • Разбор документов и картинок (4.5)
Размеры
1.2B – 750B-A37B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2026

Solar

Upstage · Южная Корея

Модели корейской Upstage. Solar Open 2 рассчитана на офисную работу с документами: 250 млрд параметров, из них активны 15 млрд, языки — английский, корейский, японский.

  • Работа с офисными документами
  • Агенты для рутинных задач
  • Помощь программистам
Размеры
10.7B – 250B-A15B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

Kanana

Kakao · Южная Корея

Компактные корейско-английские модели Kakao. Kanana 2 30B-A3B работает быстро за счёт MoE, малые версии на 1–3B подходят для обычного ПК.

  • Чат-бот поддержки
  • Классификация обращений
  • Лёгкий ассистент на своём ПК
Размеры
1.3B – 30B-A3B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRU2024–2026

T-Pro / T-Lite

Т-Банк · Россия

Модели Т-Банка, дообученные на основе Qwen специально для русского языка: заметно лучше исходной модели пишут и рассуждают по-русски. T-Lite — 8B, T-Pro — 32B на одну видеокарту; T-Search — агент для многошагового поиска на русском и английском.

  • Русскоязычный чат-бот поддержки
  • Разбор обращений и документов на русском
  • Ответы по базе знаний компании
Размеры
7B – 36B-A3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

Apertus

Swiss AI (ETH Zurich, EPFL, CSCS) · Швейцария

Государственная открытая модель Швейцарии: открыты веса, данные и рецепт, более 1000 языков в обучении. Версия 1.5 понимает изображения.

  • Многоязычный ассистент
  • Ответы по документам
  • Разбор изображений и сканов (v1.5)
Размеры
0.5B – 70B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2026

Inkling

Thinking Machines Lab · США

Флагманские открытые модели лаборатории Миры Мурати: принимают текст, изображения и аудио. Большие MoE, требуют нескольких видеокарт.

  • Корпоративный ассистент уровня флагмана
  • Разбор документов, изображений и аудио
  • Помощь в программировании
Размеры
276B-A12B, 975B-A41B
Железо
от: Кластер
Можно в коммерциюПодробнее
КодGGUF2026

Laguna

Poolside · США

Модели для агентного программирования: самостоятельно правят код в репозитории. Младшая XS запускается на Mac с 36 ГБ памяти, у S 2.1 контекст 1M токенов.

  • Агент-программист для внутренней разработки
  • Исправление ошибок и доработка кода
  • Работа с большими кодовыми базами
Размеры
33B-A3B – 225B-A23B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстOllama2024–2026

Gemma

Google · США

Компактные модели Google: хорошо работают на одном компьютере, старшие версии понимают картинки. Есть CodeGemma для кода, FunctionGemma 270M для вызова функций и быстрая DiffusionGemma.

  • Ассистент на ноутбуке без интернета
  • Разбор фото документов и чеков
  • Классификация обращений
Размеры
270M – 31B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2025–2026

OpenThinker

Open Thoughts (Стэнфорд, Беркли и другие университеты) · США

Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики регламентов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2025–2026

MiniMax

MiniMax · Китай

Крупные MoE-модели с очень длинным контекстом (до 1 млн токенов у Text-01 и M3). M3 — мультимодальная, понимает картинки. Лицензии сильно различаются от версии к версии.

  • Анализ больших архивов документов за один запрос
  • Агенты с инструментами
  • Помощь программистам
Размеры
230B-A10B – 456B-A46B
Железо
от: Кластер
Коммерция с условиямиПодробнее
МедицинаOllama2023–2026

Meditron

EPFL · Швейцария

Открытые медицинские модели швейцарского EPFL, которые дообучают поверх разных базовых моделей по клиническим руководствам. Не заменяет врача, решения принимает специалист.

  • Ответы персоналу по клиническим руководствам
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
2B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Dolphin

Cognitive Computations (Эрик Хартфорд) · США

Дообучения без встроенной цензуры поверх Llama, Mistral, Qwen и других: модель выполняет почти любые запросы. Ответственность за фильтрацию и модерацию полностью на том, кто её внедряет, — без своего фильтра клиентам её не показывать.

  • Ассистент, который не отказывает в законных, но «острых» темах
  • Внутренние инструменты под жёстким системным промптом
  • Ролевые и творческие сценарии
Размеры
0.5B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

Step

StepFun · Китай

MoE-модели StepFun, рассчитанные на быструю и дешёвую работу: при 196 млрд параметров Step-3.5/3.7-Flash задействуют около 11 млрд на токен. Есть компактные Step3-VL-10B для картинок и голосовая Step-Audio 2 mini.

  • Агенты с высокой нагрузкой
  • Разбор документов со схемами и скриншотами
  • Помощь программистам
Размеры
8B – 321B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

ERNIE 4.5

Baidu · Китай

Первая открытая линия Baidu: от крошечной 0.3B до MoE на 424 млрд параметров, есть версии с пониманием картинок. Средняя 21B-A3B помещается на одну видеокарту; ERNIE-Image 8B рисует картинки с текстом.

  • Корпоративный ассистент
  • Разбор документов и изображений
  • Классификация обращений
Размеры
0.3B – 424B-A47B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2025–2026

Arcee Trinity

Arcee AI · США

Американское семейство MoE-моделей, обученных с нуля: Nano, Mini и Large. Trinity-Large-Thinking на 398B рассуждает перед ответом.

  • Агенты с вызовом инструментов
  • Задачи с рассуждением
  • Корпоративный ассистент на своих серверах
Размеры
6B – 398B-A13B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

Apriel

ServiceNow · США

Модели ServiceNow на 15B с пошаговыми рассуждениями, которые помещаются на одну видеокарту. С версии 1.5 понимают и картинки, хорошо вызывают инструменты.

  • Ассистент с рассуждениями для внутренних сервисов
  • Вызов инструментов и корпоративные агенты
  • Разбор скриншотов и документов с картинками
Размеры
5B – 15B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответовRU2025–2026

POLLUX Judge (ai-forever)

SberDevices (ai-forever) · Россия

Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.

  • Автоматическая проверка качества ответов чат-бота на русском
  • Сравнение нескольких моделей перед выбором
  • Контроль ответов после дообучения
Размеры
4B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024–2026

Meno (Иван Бондаренко)

Иван Бондаренко (bond005), НГУ · Россия

Русскоязычные модели для работы с документами, а не для болтовни: ответы по базе знаний, извлечение сущностей и фактов из текста на русском, длинный контекст.

  • Ответы на вопросы по внутренним документам
  • Извлечение имён, дат и сумм из договоров
  • Краткое изложение длинных текстов на русском
Размеры
1.5B – 7.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2024–2026

Sarvam

Sarvam AI · Индия

Индийские модели с упором на 22 языка Индии. Sarvam 30B и 105B 2026 года это MoE-модели с сильными навыками рассуждения и работы в агентах.

  • Многоязычная поддержка клиентов
  • Задачи с рассуждением и расчётами
  • Агенты с вызовом инструментов
Размеры
2B – 105B-A10B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст2025–2026

Reka Flash и Reka Edge

Reka AI · США

Компактные модели Reka: Flash 3 на 21B для рассуждений и Reka Edge на 7B, которая быстро разбирает изображения и видео на устройстве.

  • Разбор фото и видео (Edge)
  • Поиск объектов на изображениях
  • Задачи с рассуждением (Flash)
Размеры
7B – 21B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияGGUF2026

QED-Nano

LM Provers (CMU, Hugging Face, ETH Zurich, Project Numina) · США, Швейцария, Франция

Маленькая модель 4B на Qwen3, которая пишет математические доказательства на обычном языке почти на уровне больших моделей. Запускается на ноутбуке.

  • Проверка логики рассуждений и выкладок
  • Пошаговое объяснение решений
  • Обучение и олимпиадная подготовка
Размеры
4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаOllama2025–2026

MedGemma

Google · США

Медицинская версия Gemma от Google: читает медицинские тексты и снимки (рентген, дерматология, гистология). Инструмент для врача и разработчика, не заменяет врача, решения принимает специалист.

  • Черновики выписок и заключений для проверки врачом
  • Подсказки при разборе снимков для врача
  • Поиск и пересказ медицинской литературы
Размеры
4B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаGGUF2025–2026

AntAngelMed

Ant Healthcare (Ant Group) и Центр медицинской информации провинции Чжэцзян · Китай

Крупная медицинская MoE-модель на базе Ling-flash-2.0: 100B параметров, из них в работе 6B, поэтому отвечает быстро. Не заменяет врача, решения принимает специалист.

  • Справочные ответы персоналу по клиническим вопросам
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
100B-A6B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстGGUF2023–2026

Baichuan

Baichuan Intelligence · Китай

Сначала универсальные китайские модели, с 2025 года — медицинская линия. Baichuan-M3 (на основе Qwen3-235B) обучена моделировать ход клинического рассуждения врача.

  • Справочный помощник врача
  • Предварительный опрос пациента
  • Разбор медицинских документов
Размеры
7B – 235B-A22B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Falcon

Technology Innovation Institute (TII) · ОАЭ

Семейство из Абу-Даби: от ранних Falcon 40B и 180B до гибридных Falcon-H1 и сверхмалых Falcon-H1-Tiny на 90–600M параметров для устройств.

  • Ассистент и ответы по документам
  • Работа на слабом железе и в устройствах
  • Вызов инструментов в простых агентах
Размеры
90M – 180B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Phi

Microsoft · США

Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.

  • Ассистент на ноутбуке или своём сервере
  • Задачи с рассуждением и расчётами
  • Разбор изображений и схем (vision-версии)
Размеры
1.3B – 42B-A6.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2024–2026

OLMo

Allen Institute for AI (Ai2) · США

Полностью открытые модели: опубликованы не только веса, но и данные, код обучения и промежуточные снимки. Удобно, когда важна прозрачность происхождения.

  • Ассистент и ответы по документам
  • Задачи с рассуждением (версии Think)
  • Дообучение под свои данные с понятной историей модели
Размеры
1B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2024–2026

Jamba

AI21 Labs · Израиль

Гибрид трансформера и Mamba с окном до 256K токенов: держит длинные документы быстрее обычных моделей. Jamba2 ориентирована на точные ответы по источникам.

  • Ответы по длинным регламентам и договорам
  • Поиск по базе знаний (RAG)
  • Пересказ больших документов
Размеры
3B – 398B-A94B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстGGUF2024–2026

INTELLECT

Prime Intellect · США

Модели, обученные распределённо на видеокартах со всего мира. INTELLECT-3 на 106B дообучена с подкреплением для математики, кода и агентов.

  • Задачи с рассуждением и математикой
  • Помощь в программировании
  • Агенты с вызовом инструментов
Размеры
10B – 106B-A12B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRUGGUF2024–2026

EuroLLM

Консорциум UTTER (Unbabel, университеты Лиссабона, Эдинбурга, Амстердама и др.) · Евросоюз

Европейские языковые модели, обученные на всех языках ЕС и ряде других, с упором на перевод. Русский есть. Свободная лицензия.

  • Перевод и локализация текстов
  • Ответы на вопросы на разных языках
  • Черновики писем для зарубежных партнёров
Размеры
1.7B – 22B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Кибербезопасность2025–2026

Foundation-Sec

Cisco (Foundation AI) · США

Модели Cisco для информационной безопасности на базе Llama 3.1 8B: разбор уязвимостей, угроз и инцидентов. Можно развернуть внутри периметра.

  • Разбор отчётов об уязвимостях и угрозах
  • Помощь аналитику SOC при инцидентах
  • Сопоставление угроз с MITRE ATT&CK
Размеры
8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2025

HyperCLOVA X SEED

Naver · Южная Корея

Открытые младшие модели корейского Naver: от 0.5B до 32B, включая рассуждающие Think и мультимодальные версии с пониманием картинок.

  • Лёгкий корейско-английский ассистент
  • Разбор картинок и документов
  • Классификация текстов
Размеры
0.5B – 32B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUGGUF2024–2025

Vikhr

Vikhr Models · Россия

Русскоязычные дообучения открытых моделей (Mistral, Qwen, Llama) от независимой команды Vikhr: улучшают русский язык, есть компактные версии для обычного ПК. Borealis — аудио-модель для распознавания и понимания русской речи.

  • Русскоязычный ассистент на своём ПК или сервере
  • Ответы по базе знаний (RAG)
  • Тексты и письма на русском
Размеры
0.5B – 24B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2023–2025

Jais

Inception (G42), MBZUAI и Cerebras · ОАЭ

Семейство моделей для арабского и английского языков, включая диалекты Персидского залива. Подходит компаниям, работающим с арабоязычными клиентами и госструктурами региона.

  • Чат-бот на арабском и английском
  • Перевод и пересказ документов на арабском
  • Классификация обращений клиентов
Размеры
256M – 70B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данныеGGUF2024–2025

TableGPT2 / TableGPT-R1

Чжэцзянский университет · Китай

Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.

  • Ответы на вопросы по таблицам и выгрузкам
  • Автоматический разбор данных с написанием кода
  • Помощник в BI и внутренней отчётности
Размеры
7B – 72B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2024–2025

DeepSeek-Math

DeepSeek · Китай

Математические модели DeepSeek. Первая версия 7B ввела метод обучения GRPO, V2 на 685B пишет и сама проверяет доказательства уровня олимпиад.

  • Расчёты и проверка формул
  • Проверка математических выкладок в отчётах
  • Разбор задач по шагам
Размеры
7B – 685B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2025

Hermes

Nous Research · США

Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.

  • Агенты, вызывающие функции и API
  • Извлечение данных в строгом формате JSON
  • Ассистент с гибкой настройкой роли и тона
Размеры
3B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2025

Cogito

Deep Cogito · США

Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.

  • Чат-ассистент с режимом рассуждений
  • Написание кода и вызов инструментов
  • Ответы на сложные вопросы по документам
Размеры
3B – 671B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRU2025

A-Vibe (Авито)

Авито Тех · Россия

Модель Авито на базе Qwen3-8B, переученная под русский язык: свой токенизатор, русские тексты быстрее на 15–25%. Умеет вызывать функции.

  • Описания товаров и объявлений на русском
  • Чат-бот с вызовом внутренних сервисов
  • Разбор и классификация обращений
Размеры
7.9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2025

gpt-oss

OpenAI · США

Первые открытые модели OpenAI со времён GPT-2. Рассуждения, вызов инструментов, младшая версия помещается на одну видеокарту.

  • ИИ-агент с вызовом внутренних систем
  • Ответы по регламентам
  • Черновики писем и отчётов
Размеры
20B, 120B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRU2024–2025

Ruadapt (RuadaptQwen)

НИВЦ МГУ, лаборатория LAIR (RefalMachine) · Россия

Модели Qwen, переделанные под русский язык: заменён токенизатор и проведено дообучение на русских текстах. За счёт этого русский текст генерируется до двух раз быстрее, чем у исходной модели того же размера.

  • Русскоязычный ассистент на своём сервере
  • Ответы по документам компании (RAG) на русском
  • Разбор и пересказ длинных русских текстов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025

Seed-OSS

ByteDance · Китай

Открытая модель ByteDance на 36B с контекстом до 512 тыс. токенов и настраиваемым «бюджетом размышлений». Помещается на одну мощную видеокарту.

  • Разбор длинных документов
  • Агенты с инструментами
  • Корпоративный ассистент
Размеры
36B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Текст2024–2025

Grok (открытые веса)

xAI · США

xAI выкладывает веса прошлых поколений Grok. Модели очень большие и требуют кластера видеокарт, поэтому на практике их запускают редко.

  • Исследования больших моделей
  • Ассистент на собственной инфраструктуре
  • Генерация и анализ текстов
Размеры
314B (Grok-1), Grok-2 крупнее
Железо
от: Кластер
Коммерция с условиямиПодробнее
МедицинаGGUF2025

II-Medical

Intelligent Internet · Великобритания

Рассуждающие медицинские модели на Qwen3, которые рассчитаны на запуск на обычном компьютере. Не заменяет врача, решения принимает специалист.

  • Справочные ответы персоналу с ходом рассуждения
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2024–2025

SmolLM

Hugging Face · США

Крошечные открытые модели Hugging Face для телефонов и ноутбуков. SmolLM3 на 3B умеет рассуждать и держит длинный контекст, весь рецепт обучения открыт.

  • Простой ассистент прямо на устройстве
  • Классификация и маршрутизация обращений
  • Основа для дообучения под узкую задачу
Размеры
135M – 3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассуждения2025

AceMath / AceReason

NVIDIA · США

Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Разбор задач по программированию
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ПереводRUGGUF2024–2025

Tower

Unbabel · Португалия

Языковые модели, заточенные под перевод и работу с многоязычными текстами: перевод, правка, оценка качества перевода. Русский есть. Некоммерческая лицензия.

  • Перевод с учётом контекста и терминов
  • Редактура машинного перевода
  • Оценка качества готового перевода
Размеры
2B – 72B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
КибербезопасностьGGUF2023–2025

SecGPT

Clouditera · Китай

Китайское открытое семейство для кибербезопасности: разбор уязвимостей, анализ логов и трафика, объяснение команд и скриптов.

  • Разбор уязвимостей и подготовка рекомендаций по исправлению
  • Анализ логов и восстановление цепочки атаки
  • Объяснение подозрительных команд и скриптов
Размеры
1.5B – 14B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КибербезопасностьGGUF2025

Trendyol Cybersecurity LLM

Trendyol · Турция

Модели безопасности от крупного турецкого маркетплейса, выложены в формате GGUF: разбор алертов и инцидентов, английский и турецкий языки.

  • Разбор алертов и первичная оценка инцидента
  • Объяснение подозрительной активности в отчётах
  • Помощь дежурной смене центра мониторинга
Размеры
32B и 70B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстOllama2025

DeepSeek-R1

DeepSeek · Китай

Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.

  • Сложные расчёты и проверка логики
  • Анализ договоров и регламентов
  • Помощь программистам
Размеры
1,5B – 671B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодRU2025

Kodify-Nano (МТС AI)

МТС AI (MWS AI) · Россия

Маленький помощник программиста от МТС AI, понимает запросы на русском. Работает локально, есть плагины для VS Code и JetBrains.

  • Подсказки и дописывание кода в редакторе
  • Объяснение кода на русском
  • Черновики тестов и документации
Размеры
1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2025

Llama

Meta · США

Модели, с которых начался массовый open source в ИИ. Огромная экосистема дообученных версий и инструментов.

  • Ассистент для сотрудников
  • Суммаризация встреч и документов
  • Основа для дообучения под отрасль
Размеры
1B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUGGUF2023–2025

Saiga

Илья Гусев (IlyaGusev) · Россия

Самая известная русскоязычная доучка сообщества: чужие открытые модели (Llama, Mistral, Gemma, YandexGPT) дообучены отвечать на русском как ассистент. Удобная отправная точка для русского чат-бота на своём сервере.

  • Чат-ассистент на русском языке
  • Ответы на вопросы по базе знаний компании
  • Черновики писем, описаний и постов на русском
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияOllama2024–2025

QwQ

Qwen (Alibaba) · Китай

Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики договоров и регламентов
Размеры
32B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

s1

Стэнфордский университет · США

Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.

  • Расчёты и проверка формул
  • Разбор сложных задач по шагам
  • Обучение
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Light-R1

Qihoo 360 · Китай

Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.

  • Расчёты и проверка формул
  • Разбор задач по шагам
  • Основа для своего дообучения рассуждениям
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютера2024–2025

xLAM

Salesforce · США

Модели Salesforce для вызова функций и работы агентов: выбирают нужный инструмент и заполняют его параметры. Сильны в тестах, но лицензия некоммерческая.

  • Вызов API и внутренних сервисов по запросу пользователя
  • Агенты с несколькими шагами и инструментами
  • Сравнение подходов перед выбором коммерческой модели
Размеры
1B – 8x22B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Финансы2025

Fin-R1

Шанхайский университет финансов и экономики (SUFE) · Китай

Модель с рассуждениями для финансовых задач на базе Qwen2.5-7B: расчёты, разбор отчётов, вопросы по регулированию. Обучена на китайских и английских данных.

  • Финансовые расчёты с пошаговым объяснением
  • Ответы на вопросы по отчётности
  • Разбор таблиц с финансовыми данными
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Sky-T1

NovaSky (Sky Computing Lab, Беркли) · США

Рассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.

  • Расчёты и проверка формул
  • Разбор задач по шагам
  • Основа для своего дообучения рассуждениям
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2025

Tulu

Ai2 · США

Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.

  • Ассистент для сотрудников на своём сервере
  • Математика и точное следование инструкциям
  • Образец рецепта для собственного дообучения
Размеры
7B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Кибербезопасность2025

Llama-Primus

Trend Micro · Япония

Модели Trend Micro для кибербезопасности на базе Llama 3.1 8B, дообученные на корпусе текстов по ИБ. Есть версия с рассуждениями.

  • Ответы на вопросы по угрозам и уязвимостям
  • Разбор отчётов о кибератаках
  • Основа для дообучения под задачи SOC
Размеры
8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстGGUF2025

ALLaM

HUMAIN (ранее SDAIA) · Саудовская Аравия

Саудовская модель для арабского и английского языков, обученная с нуля. В открытом доступе одна версия на 7B.

  • Ассистент на арабском языке
  • Ответы на вопросы по документам
  • Генерация и редактирование текстов на арабском
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2024–2025

Qwen2.5-Math

Qwen (Alibaba) · Китай

Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.

  • Расчёты и проверка формул
  • Проверка расчётов в сметах и отчётах
  • Разбор задач по шагам
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Финансы2023–2024

XuanYuan

Du Xiaoman (Duxiaoman-DI) · Китай

Крупное китайское семейство моделей для финансовой отрасли: консультации, разбор документов и длинные тексты до 8k–16k. Не инвестиционная рекомендация: решения принимает специалист.

  • Ответы на вопросы клиентов по банковским продуктам
  • Разбор длинных финансовых документов
  • Внутренний помощник по регламентам финансовой компании
Размеры
6B – 176B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllama2024

Athene

Nexusflow · США

Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.

  • Исследование агентов и вызова функций
  • Сравнение с коммерческими моделями
  • Эксперименты с чат-ассистентом
Размеры
70B – 72B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
ТекстRU2024

Cotype Nano (МТС AI)

МТС AI (MWS AI) · Россия

Лёгкая русскоязычная модель от МТС AI для текстов на русском: ответы, пересказ, черновики. Есть готовая версия для процессора без видеокарты. Старшая Cotype Pro открыто не выложена.

  • Черновики писем и описаний на русском
  • Краткий пересказ документов
  • Ответы на типовые вопросы клиентов
Размеры
1.5B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Финансы2023–2024

FinMA (PIXIU)

The Fin AI / ChanceFocus · международный проект

Одно из первых открытых семейств моделей для финансового текста: разбор отчётности, новостей и вопросов по цифрам. Не инвестиционная рекомендация: решения принимает специалист.

  • Разбор финансовой отчётности и пресс-релизов
  • Ответы на вопросы по числовым данным из документов
  • Классификация финансовых текстов
Размеры
0.5B – 30B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Финансы2023–2024

FinGPT

AI4Finance Foundation · США

Открытый набор лёгких надстроек к обычным языковым моделям для работы с финансовыми текстами и новостями. Не инвестиционная рекомендация: решения принимает специалист.

  • Оценка тона финансовых новостей и отчётов
  • Разметка упоминаний компаний и инструментов в тексте
  • Подготовка сводок по потоку деловых новостей
Размеры
адаптеры к базовым моделям 6B – 20B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

StableLM и Stable Code

Stability AI · Великобритания

Малые модели Stability AI: StableLM 2 на 1.6B знает 7 европейских языков, Stable Code на 3B дописывает код. Обновлений с 2024 года нет.

  • Лёгкий чат-бот на обычном ПК
  • Автодополнение кода в редакторе
  • Основа для дообучения под свою задачу
Размеры
1.6B – 12B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаGGUFНе развивается2023–2024

Med42

M42 Health · ОАЭ

Клинические модели абу-дабийской M42 на основе Llama, настроенные отвечать на медицинские вопросы. Не заменяет врача, решения принимает специалист.

  • Справочные ответы персоналу по клиническим вопросам
  • Черновики выписок и писем для проверки врачом
  • Поиск по медицинской литературе
Размеры
8B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ФинансыНе развивается2024

Palmyra-Fin

Writer · США

Крупная модель под финансовые документы с окном контекста около 131 тыс. токенов: держит длинные отчёты целиком. Не инвестиционная рекомендация: решения принимает специалист.

  • Работа с длинными годовыми отчётами и проспектами
  • Сводки и выжимки по финансовым документам
  • Поиск ответов внутри большого пакета документов
Размеры
70B (в карточке указано 72 млрд параметров)
Железо
от: Кластер
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

OpenChat

OpenChat (Университет Цинхуа) · Китай

Дообучения Mistral 7B и Llama 3 8B по методу C-RLFT, которые в 2023–2024 годах догоняли ChatGPT-3.5 при размере 7–8B. Лёгкий универсальный ассистент для слабого сервера.

  • Чат-ассистент на недорогом сервере
  • Черновики писем и ответов
  • Помощь с простым кодом
Размеры
7B – 13B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

Yi

01.AI · Китай

Двуязычные (английский и китайский) модели 01.AI на 6–34B с версиями на контекст до 200 тыс. токенов. Новых открытых выпусков с 2024 года нет.

  • Чат-ассистент на одной видеокарте
  • Разбор длинных документов
  • Классификация и извлечение данных из текста
Размеры
6B – 34B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстНе развивается2024

SaulLM

Equall · Франция

Языковые модели для юридических текстов, дообученные на базах права США и Европы (основа Mistral и Mixtral). Только английский.

  • Разбор договоров на английском
  • Поиск рисков и нестандартных условий
  • Черновики юридических справок
Размеры
7B – 141B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаGGUFНе развивается2024

BioMistral

Авиньонский университет и Нантский университет · Франция

Mistral 7B, дообученная на статьях PubMed Central, плюс несколько слияний с общей моделью. Компактная и простая в запуске. Не заменяет врача, решения принимает специалист.

  • Поиск и пересказ медицинских статей
  • Черновики справочных материалов для персонала
  • Разбор медицинской терминологии
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаGGUFНе развивается2024

OpenBioLLM

Saama AI Research · Индия

Llama 3, дообученная на медицинских и биологических данных. Одна из первых сильных открытых медицинских моделей 2024 года. Не заменяет врача, решения принимает специалист.

  • Извлечение данных из медицинских документов
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
8B, 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

Zephyr

Hugging Face (H4) · США

Учебные чат-модели Hugging Face на базе Mistral, Gemma и Mixtral с открытым рецептом дообучения. Zephyr 7B Beta показал, что маленькую модель можно «воспитать» до уровня крупных без ручной разметки людьми.

  • Лёгкий чат-ассистент
  • Образец и отправная точка для своего дообучения
  • Черновики текстов и ответов
Размеры
7B – 141B-A35B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUНе развивается2023–2024

FRED-T5

Сбер (ai-forever) · Россия

Русская модель «текст в текст» от Сбера, наследница ruT5 (2021). Небольшая и быстрая: её дообучают на пересказ, перефразирование и исправление ошибок в русском тексте, есть готовые версии проверки орфографии SAGE.

  • Исправление орфографии и опечаток в русском тексте
  • Краткий пересказ и перефразирование
  • Нормализация заявок и обращений перед обработкой
Размеры
95M – 1.7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023–2024

TinyLlama

TinyLlama (исследователи SUTD) · Сингапур

Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.

  • Простые чат-боты на слабом железе
  • Эксперименты и обучение команды
  • Основа для дообучения под узкую задачу
Размеры
1.1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КибербезопасностьGGUFНе развивается2023–2024

ZySec

ZySec AI · Индия

Небольшой открытый помощник для специалистов по безопасности: вопросы по стандартам, разбор угроз и уязвимостей, подготовка внутренних документов.

  • Ответы на вопросы по политикам и стандартам безопасности
  • Первичный разбор сообщений об угрозах
  • Черновики внутренних инструкций по защите
Размеры
2.8B и 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023–2024

WizardLM, WizardCoder, WizardMath

WizardLM (Microsoft и Пекинский университет) · США / Китай

Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.

  • Сложные многошаговые инструкции
  • Помощь программистам
  • Решение математических задач
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023

NeuralChat

Intel · США

Дообученная Mistral 7B от Intel, показывавшая обучение и запуск на процессорах и ускорителях Intel. Устарела, интересна как пример оптимизации под железо Intel.

  • Простой чат-ассистент
  • Эксперименты с запуском на железе Intel
  • Основа для дообучения
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ФинансыGGUFНе развивается2023

AdaptLLM Finance

AdaptLLM · не раскрыта

Дообученные под финансы версии Llama 2: разбор отраслевых текстов, отчётов и вопросов по терминам. Не инвестиционная рекомендация: решения принимает специалист.

  • Разбор финансовых новостей и отчётов
  • Ответы на вопросы по финансовой терминологии
  • Основа для дообучения под свою финансовую задачу
Размеры
7B и 13B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023

Orca 2

Microsoft Research · США

Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.

  • Исследования методов рассуждения
  • Сравнение с современными малыми моделями
  • Обучение специалистов
Размеры
7B – 13B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Табличные данныеНе развивается2023

TableLlama

OSU NLP Group, Университет штата Огайо · США

Универсальная модель по таблицам: заполнение пропусков, поиск строк, сопоставление колонок и ответы на вопросы по данным.

  • Ответы на вопросы по таблицам из документов
  • Сопоставление колонок разных таблиц
  • Поиск и дополнение записей в справочниках
Размеры
7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Разбор текстаНе развивается2022–2023

ESCOXLM-R и JobBERT (ITU Copenhagen)

Mike Zhang, Rob van der Goot, Barbara Plank (IT University of Copenhagen и LMU Munich) · Дания

Научная линейка моделей для текстов рынка труда: обучены на объявлениях о работе и европейском справочнике профессий ESCO, вытаскивают из вакансий навыки и требования. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.

  • Извлечение навыков и требований из текста вакансии
  • Приведение навыков к единому справочнику ESCO
  • Классификация вакансий и должностей
Размеры
110M – 560M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ФинансыНе развивается2023

DISC-FinLLM

Fudan-DISC, Университет Фудань · Китай

Финансовый помощник из нескольких дообученных экспертов: консультации, расчёты, разбор документов и поиск по базе знаний. Не инвестиционная рекомендация: решения принимает специалист.

  • Консультации по финансовым вопросам внутри компании
  • Разбор финансовых документов и новостей
  • Подсказки сотрудникам фронт-офиса
Размеры
13B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
МедицинаНе развивается2023

Clinical Camel

Лаборатория Бо Ванга (Университет Торонто, Vector Institute) · Канада

Ранняя медицинская модель на Llama 2 70B, обученная на диалогах по медицинским текстам. Сейчас интересна в основном для исследований. Не заменяет врача, решения принимает специалист.

  • Исследовательские пилоты по медицинским диалогам
  • Учебные материалы для персонала
  • Сравнение с новыми медицинскими моделями
Размеры
70B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
ТекстRUGGUFНе развивается2022–2023

mGPT

Сбер (ai-forever) · Россия

Многоязычная модель Сбера на 61 язык, включая языки народов России и СНГ. Есть отдельные доучки под бурятский, якутский, татарский, башкирский, казахский и другие языки — редкость для открытых моделей.

  • Тексты на языках народов России и СНГ
  • Основа для дообучения под редкий язык
  • Черновики и шаблоны на нескольких языках
Размеры
1.3B – 13B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023

Vicuna

LMSYS (Беркли и партнёры) · США

Одна из первых открытых чат-моделей 2023 года: LLaMA, дообученная на диалогах пользователей ChatGPT. Историческая веха, сегодня уступает любой современной модели того же размера.

  • Эксперименты и обучение команды
  • Простой чат-ассистент для тестов
  • Сравнение с новыми моделями
Размеры
7B – 33B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUGGUFНе развивается2023

ruGPT-3.5

Сбер (ai-forever) · Россия

Базовая русскоязычная модель Сбера на 13 млрд параметров, из дообученной версии которой вырос GigaChat. Продолжает тексты на русском и английском, контекст всего 2048 токенов; сегодня интересна как основа для узкого дообучения.

  • Основа для дообучения под узкую русскую задачу
  • Генерация шаблонных русских текстов
  • Эксперименты с русскоязычными моделями без ограничений лицензии
Размеры
13B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстНе развивается2022–2023

Flan-T5 и Flan-UL2

Google · США

Компактные модели «вход-выход», обученные выполнять инструкции. До сих пор используются как дешёвая основа для классификации, извлечения и коротких ответов.

  • Классификация обращений и документов
  • Извлечение полей из текста
  • Короткие ответы и пересказ
Размеры
80M – 20B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстНе развивается2022–2023

Pythia и GPT-NeoX

EleutherAI · США

Полностью открытые модели некоммерческой лаборатории EleutherAI: GPT-NeoX-20B и серия Pythia с опубликованными промежуточными снимками обучения.

  • Базовая модель для дообучения
  • Исследование поведения моделей
  • Простая генерация и дополнение текста
Размеры
70M – 20B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстНе развивается2022

OPT

Meta · США

Ранняя открытая серия Meta, повторяющая по размерам GPT-3. Устарела, полезна для исследований и сравнения.

  • Исследовательские эксперименты
  • Обучение специалистов
  • Сравнение с современными моделями
Размеры
125M – 66B (175B по запросу)
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ТекстGGUFНе развивается2022

BLOOM

BigScience (Hugging Face и сообщество) · Франция

Одна из первых больших открытых моделей, обученная сообществом из сотен исследователей на 46 языках. Сегодня интересна скорее как историческая веха.

  • Генерация и перевод текстов на многих языках
  • Эксперименты и обучение команды
  • Базовая модель для дообучения под узкую задачу
Размеры
560M – 176B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение