Нейросети для разработки ПО

Командам разработки открытые модели помогают писать и проверять код, генерировать тесты и документацию, искать по кодовой базе и автоматизировать рутину агентами. Локальный запуск позволяет не отправлять исходники во внешние сервисы. Смотрите на поддержку ваших языков и фреймворков, длину контекста, лицензию и требования к видеокарте.

В подборке 165 семейств открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
ТекстOllama2023–2026

DeepSeek

DeepSeek · Китай

Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.

  • Ассистент для сотрудников на своём сервере
  • Разбор длинных договоров и отчётов
  • Агенты, которые работают с инструментами и API
Размеры
7B – 1.6T-A49B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2026

InternLM / Intern-S

Shanghai AI Laboratory · Китай

Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.

  • Помощник исследователя: статьи, формулы, данные
  • Разбор научных и технических документов
  • Корпоративный чат на малых моделях
Размеры
1.8B – около 1T
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

MiMo

Xiaomi · Китай

Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.

  • Логические и расчётные задачи
  • Агенты с инструментами
  • Помощь программистам
Размеры
7B – 1,02T-A42B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст2024–2026

MiniCPM

OpenBMB (ModelBest и Университет Цинхуа) · Китай

Компактные текстовые модели для работы прямо на устройстве: ноутбуке, телефоне, мини-ПК. MiniCPM5 на 1B и 2B ориентированы на вызов инструментов и длинный контекст.

  • Локальный чат-ассистент без облака
  • Извлечение данных и классификация текстов
  • Вызов инструментов и простые агенты на слабом железе
Размеры
0.5B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст2024–2026

K2 (K2-Think, K2-V2, K2-Horizon)

MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ

Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.

  • Рассуждения, математика и технические вопросы
  • Разбор длинных документов
  • Агенты и написание кода
Размеры
0.9B – 375B-A23B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

LLaDA

Жэньминьский университет (GSAI) и Ant Group (inclusionAI) · Китай

Диффузионные языковые модели: текст пишется не по одному слову, а сразу блоками с последующим уточнением, что ускоряет генерацию. LLaDA2.2 умеет править уже написанное и рассчитана на агентов. Генератор картинок LLaDA-Image — отдельный продукт.

  • Быстрая генерация кода и текстов
  • Агентные сценарии с длинным контекстом
  • Исследования альтернатив обычным LLM
Размеры
8B – 100B (MoE)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRU2026

Zarya (ai-forever)

SberDevices (ai-forever) · Россия

Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.

  • Эксперименты с ускорением генерации
  • Дообучение небольших моделей под свои задачи
  • Исследования
Размеры
0.6B – 4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Qwen

Alibaba · Китай

Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.

  • Чат-бот и ассистент по базе знаний
  • Ответы на письма и обращения
  • Разбор и классификация документов
Размеры
0,6B – 2,4T-A95B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGRU2024–2026

FRIDA / Giga-Embeddings

Сбер (SberDevices) · Россия

Эмбеддинги Сбера, заточенные под русский язык: по данным разработчиков, в числе лучших на русскоязычных тестах поиска. FRIDA компактная, Giga-Embeddings мощнее.

  • Поиск по русскоязычным документам
  • RAG для чат-ботов на русском
  • Классификация обращений и отзывов
Размеры
480M – 10B-A1.8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Речь в текстGGUF2024–2026

Moonshine

Moonshine AI (Useful Sensors) · США

Очень маленькие и быстрые модели распознавания речи для телефонов, планшетов и встраиваемых устройств. Вторая версия работает потоково и выдаёт текст, пока человек ещё говорит.

  • Голосовое управление устройствами
  • Распознавание на телефоне без интернета
  • Живые субтитры
Размеры
27M – 245M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2026

GLM (ChatGLM)

Zhipu AI (Z.ai) · Китай

Одна из старейших китайских открытых линий: от ChatGLM-6B до GLM-5.3. Сильна в агентных задачах и программировании; GLM-5.3-Flash понимает картинки и выходит под MIT.

  • Корпоративный чат-ассистент
  • Агенты для рутинных офисных задач
  • Помощь программистам
Размеры
1.5B – 744B-A40B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2024–2026

Hunyuan / Hy

Tencent · Китай

Языковые модели Tencent: от малых 0.5B–7B до Hy4-preview на 770 млрд параметров. С 2026 года линия переименована в Hy, а новые версии вышли под Apache 2.0.

  • Корпоративный ассистент
  • Перевод и работа с многоязычными текстами
  • Агенты с инструментами
Размеры
0.5B – 770B-A49B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2025–2026

Ling / Ring

Ant Group (inclusionAI) · Китай

Семейство Ant Group: Ling — обычные модели, Ring — рассуждающие. Есть и триллионные флагманы, и экономичная Ling-3.0-tiny, которой хватает 1,3 млрд активных параметров.

  • Корпоративный ассистент
  • Агенты для офисных процессов
  • Финансовая аналитика (есть версия Fin)
Размеры
7.9B-A1.3B – 1T
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2024–2026

NVIDIA Nemotron

NVIDIA · США

Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).

  • Агенты с вызовом инструментов
  • Задачи с рассуждением и расчётами
  • Ответы по длинным документам
Размеры
4B – 550B-A55B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

IBM Granite

IBM · США

Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.

  • Ответы по внутренним документам (RAG)
  • Вызов инструментов и работа в агентах
  • Извлечение данных и классификация
Размеры
350M – 34B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2026

Muse Glimmer

Meta Superintelligence Labs · США

Открытая модель Meta для агентов на доступном железе: дистиллирована из закрытой Muse Spark, понимает текст и картинки, обучена на 100+ языках.

  • Агенты с вызовом инструментов
  • Разбор скриншотов, графиков и документов
  • Многоязычный ассистент
Размеры
30B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Разбор текста2024–2026

GLiNER

Урчаде Заратиана и Fastino AI · Франция / США

Находит в тексте нужные сущности без обучения: просто перечисляете, что искать (имя, сумма, дата). GLiNER2 заодно классифицирует текст. Многоязычные версии понимают русский.

  • Извлечение имён, сумм и дат из писем и договоров
  • Разбор заявок на поля CRM
  • Классификация обращений по темам
Размеры
около 50M – 500M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютера2025–2026

OpenCUA / Qwen-CUA

XLANG Lab (Гонконгский университет) · Китай

Полностью открытые агенты для рабочего стола: веса, данные и код обучения. Работают в Windows, macOS и Linux, свежий Qwen-CUA управляет компьютером обычными кликами и клавишами.

  • Работа в настольных программах без API
  • Перенос данных между системами
  • Прогон пользовательских сценариев для тестов
Размеры
7B – около 400B (MoE)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Агенты для компьютераGGUF2025–2026

UI-Venus

Ant Group (inclusionAI) · Китай

Семейство Ant Group для поиска элементов на экране и выполнения задач в интерфейсе телефона и компьютера. UI-Venus-2 отдельно обучали отказываться от опасных действий.

  • Автоматизация действий в мобильных приложениях
  • Заполнение форм в веб-интерфейсах
  • Автотесты интерфейсов
Размеры
2B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КодOllama2026

Ornith

DeepReinforce · не раскрыта

Модели для агентной разработки: сами строят план и обвязку под задачу и выполняют её в терминале. Дообучены на базе Qwen 3.5 и Gemma 4, работают с Claude Code, OpenHands и похожими инструментами.

  • Агент-разработчик в терминале
  • Исправление ошибок по описанию задачи
  • Разбор и доработка большого репозитория
Размеры
9B – 397B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Mistral

Mistral AI · Франция

Европейские модели с упором на скорость. Mixtral — одна из первых открытых моделей на архитектуре «смесь экспертов»; есть версии с картинками (Pixtral, Medium 3.5), для доказательств в Lean и модерации (Shieldstral).

  • Быстрые ответы в чате
  • Извлечение данных из текста
  • Перевод и работа с несколькими языками
Размеры
3B – 675B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Код2025–2026

KAT-Coder / KAT-Dev

Kwaipilot (Kuaishou) · Китай

Модели Kuaishou для агентной разработки, обученные решать реальные задачи в репозиториях. KAT-Coder-V2.5-Dev (35B, активны 3B) — открытая версия их закрытого флагмана.

  • Агент, исправляющий задачи в репозитории
  • Генерация и рефакторинг кода
  • Автоматизация рутинных задач разработки
Размеры
32B – 72B, 35B-A3B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Поиск и RAGRU2025–2026

NVIDIA Nemotron Embed

NVIDIA · США

Эмбеддинги NVIDIA для поиска и RAG. Nemotron-3-Embed 2026 года вышли под свободной лицензией OpenMDW и работают на многих языках.

  • Поиск по корпоративным документам
  • RAG для чат-ботов и ассистентов
  • Поиск по картинкам и страницам (VL-версии)
Размеры
1B – 8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

Kimi

Moonshot AI · Китай

Сверхкрупные MoE-модели Moonshot для агентной работы. K3 на 2,8 трлн параметров — самая большая открытая модель на момент выхода, с контекстом до 1 млн токенов и пониманием картинок; K2.7-Code заточена под программирование.

  • Многошаговые агенты: поиск, сбор данных, отчёты
  • Глубокий анализ документов
  • Помощь программистам
Размеры
16B-A3B – 2.8T-A104B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

EXAONE

LG AI Research · Южная Корея

Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.

  • Корпоративный ассистент
  • Работа с корейскими и английскими текстами
  • Разбор документов и картинок (4.5)
Размеры
1.2B – 750B-A37B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2023–2026

Solar

Upstage · Южная Корея

Модели корейской Upstage. Solar Open 2 рассчитана на офисную работу с документами: 250 млрд параметров, из них активны 15 млрд, языки — английский, корейский, японский.

  • Работа с офисными документами
  • Агенты для рутинных задач
  • Помощь программистам
Размеры
10.7B – 250B-A15B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстGGUF2026

Inkling

Thinking Machines Lab · США

Флагманские открытые модели лаборатории Миры Мурати: принимают текст, изображения и аудио. Большие MoE, требуют нескольких видеокарт.

  • Корпоративный ассистент уровня флагмана
  • Разбор документов, изображений и аудио
  • Помощь в программировании
Размеры
276B-A12B, 975B-A41B
Железо
от: Кластер
Можно в коммерциюПодробнее
КодGGUF2026

Laguna

Poolside · США

Модели для агентного программирования: самостоятельно правят код в репозитории. Младшая XS запускается на Mac с 36 ГБ памяти, у S 2.1 контекст 1M токенов.

  • Агент-программист для внутренней разработки
  • Исправление ошибок и доработка кода
  • Работа с большими кодовыми базами
Размеры
33B-A3B – 225B-A23B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Агенты для компьютераGGUF2025–2026

Fara

Microsoft · США

Небольшие модели Microsoft для работы в браузере: смотрят на страницу и кликают, печатают, прокручивают. Рассчитаны на запуск прямо на рабочем компьютере без облака.

  • Заполнение веб-форм и заявок
  • Сбор данных из веб-кабинетов без API
  • Проверка сайтов по сценарию
Размеры
4B – 27B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
РеранкерыGGUF2024–2026

Jina Reranker

Jina AI · Германия

Сильные многоязычные реранкеры; m0 сортирует и страницы-картинки (сканы, слайды). Свежие версии открыты только для некоммерческого использования.

  • Уточнение выдачи перед ответом чат-бота
  • Сортировка найденных страниц PDF и слайдов
  • Поиск по каталогу и базе знаний
Размеры
33M – 2.4B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Реранкеры2026

R3 (R3-Embedding и R3-Rerank)

Tencent · Китай

Пара небольших моделей Tencent на базе Qwen3 для подбора ИИ-агенту нужного навыка (skill) под запрос: эмбеддинг находит кандидатов, реранкер выбирает лучший.

  • Выбор инструмента или навыка для ИИ-агента
  • Маршрутизация запросов между сценариями бота
  • Поиск по каталогу внутренних инструментов
Размеры
0.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодGGUF2025–2026

Mellum

JetBrains · Чехия

Модели JetBrains для быстрого автодополнения кода. Mellum2 (12B, активны 2.5B) уже полноценный помощник: пишет и правит код, вызывает инструменты, рассуждает.

  • Быстрое автодополнение кода на своём сервере
  • Помощник разработчика без отправки кода в облако
  • Дообучение на коде компании
Размеры
4B – 12B-A2.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2025–2026

OpenThinker

Open Thoughts (Стэнфорд, Беркли и другие университеты) · США

Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики регламентов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2025–2026

MiniMax

MiniMax · Китай

Крупные MoE-модели с очень длинным контекстом (до 1 млн токенов у Text-01 и M3). M3 — мультимодальная, понимает картинки. Лицензии сильно различаются от версии к версии.

  • Анализ больших архивов документов за один запрос
  • Агенты с инструментами
  • Помощь программистам
Размеры
230B-A10B – 456B-A46B
Железо
от: Кластер
Коммерция с условиямиПодробнее
Поиск и RAGRUGGUF2023–2026

Jina Embeddings

Jina AI · Германия

Сильные многоязычные эмбеддинги с длинным контекстом, v5-omni понимает текст, картинки и аудио. Свежие версии открыты только для некоммерческого использования.

  • Поиск по документам на многих языках
  • Поиск по картинкам и сканам
  • Классификация и кластеризация
Размеры
33M – 3.8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Dolphin

Cognitive Computations (Эрик Хартфорд) · США

Дообучения без встроенной цензуры поверх Llama, Mistral, Qwen и других: модель выполняет почти любые запросы. Ответственность за фильтрацию и модерацию полностью на том, кто её внедряет, — без своего фильтра клиентам её не показывать.

  • Ассистент, который не отказывает в законных, но «острых» темах
  • Внутренние инструменты под жёстким системным промптом
  • Ролевые и творческие сценарии
Размеры
0.5B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

Step

StepFun · Китай

MoE-модели StepFun, рассчитанные на быструю и дешёвую работу: при 196 млрд параметров Step-3.5/3.7-Flash задействуют около 11 млрд на токен. Есть компактные Step3-VL-10B для картинок и голосовая Step-Audio 2 mini.

  • Агенты с высокой нагрузкой
  • Разбор документов со схемами и скриншотами
  • Помощь программистам
Размеры
8B – 321B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Агенты для компьютераGGUF2025–2026

Holo

H Company · Франция

Французское семейство моделей для управления браузером и компьютером: точно находит нужный элемент на экране и ведёт многошаговые задачи. Свежие Holo3 и 3.1 открыты под Apache 2.0.

  • Работа в веб-кабинетах и старых программах без API
  • Заполнение форм и заявок
  • Проверка интерфейсов по сценарию
Размеры
0.8B – 235B-A22B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Реранкеры2025–2026

Llama Nemotron Rerank

NVIDIA · США

Небольшой реранкер NVIDIA на 1B. У версии vl на вход идут и страницы документов картинками, а не только текст. В карточке заявлена многоязычность без списка языков.

  • Переупорядочивание фрагментов перед ответом ИИ-помощника
  • Сортировка найденных страниц сканов и PDF
  • Поиск по внутренним регламентам и инструкциям
Размеры
1B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Прогнозы2024–2026

Timer (THUML)

THUML, Университет Цинхуа · Китай

Компактная базовая модель прогнозов от лаборатории Цинхуа: обучена на большом наборе разнородных рядов и дообучается под свои данные.

  • Прогноз спроса и нагрузки
  • Прогноз показаний датчиков на производстве
  • Дообучение прогноза под свою историю
Размеры
84M (timer-base)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2026

Granite Embedding

IBM · США

Лёгкие эмбеддинги IBM для корпоративного поиска, обученные на данных с понятными правами. R2 2026 года стали многоязычными.

  • Поиск по корпоративным документам
  • RAG на обычном сервере без видеокарты
  • Переранжирование результатов
Размеры
30M – 311M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПрогнозыGGUF2025–2026

Toto

Datadog · США

Модель прогнозов от Datadog, обученная на метриках серверов и приложений. Особенно сильна для IT-мониторинга: нагрузка, задержки, ошибки.

  • Прогноз нагрузки на серверы
  • Поиск аномалий в метриках
  • Планирование мощностей
Размеры
4M – 2.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2025–2026

Arcee Trinity

Arcee AI · США

Американское семейство MoE-моделей, обученных с нуля: Nano, Mini и Large. Trinity-Large-Thinking на 398B рассуждает перед ответом.

  • Агенты с вызовом инструментов
  • Задачи с рассуждением
  • Корпоративный ассистент на своих серверах
Размеры
6B – 398B-A13B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Модерация и безопасностьOllama2024–2026

Granite Guardian

IBM · США

Модели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.

  • Проверка запросов и ответов бота
  • Поиск выдуманных фактов в ответах по базе знаний
  • Проверка своих правил, заданных текстом
Размеры
38M – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютера2024–2026

ShowUI

Show Lab (Национальный университет Сингапура) · Сингапур

Лёгкая модель для работы с интерфейсом: находит кнопки и поля по описанию и выполняет действия в вебе и на телефоне. ShowUI-π умеет перетаскивание мышью.

  • Клики и заполнение форм по описанию задачи
  • Автотесты веб-интерфейсов
  • Помощник на слабом компьютере без облака
Размеры
2B (ShowUI), около 500M (ShowUI-π)
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Синтез речи2025–2026

Kyutai STT, TTS и Pocket TTS

Kyutai · Франция

Потоковые модели распознавания и синтеза речи от авторов Moshi: начинают говорить и расшифровывать, не дожидаясь конца фразы. Pocket TTS (100M) работает на процессоре. Английский, французский и ещё несколько европейских языков, русского нет.

  • Потоковая расшифровка речи для голосовых ботов
  • Озвучка ответов с минимальной задержкой
  • Синтез речи на сервере без видеокарты (Pocket TTS)
Размеры
100M (Pocket TTS) – 2.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

Apriel

ServiceNow · США

Модели ServiceNow на 15B с пошаговыми рассуждениями, которые помещаются на одну видеокарту. С версии 1.5 понимают и картинки, хорошо вызывают инструменты.

  • Ассистент с рассуждениями для внутренних сервисов
  • Вызов инструментов и корпоративные агенты
  • Разбор скриншотов и документов с картинками
Размеры
5B – 15B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2025–2026

Rnj-1

Essential AI · США

Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.

  • Генерация и исправление кода
  • Агент-разработчик на одной видеокарте
  • Решение технических и научных задач
Размеры
8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGGGUF2025–2026

Octen Embedding

Octen · США / Сингапур

Дообученные Qwen3-Embedding от стартапа Octen под поиск в юридических, финансовых и медицинских текстах. Версия 8B на январь 2026 возглавляла рейтинг RTEB.

  • Поиск по договорам и судебной практике
  • Поиск по финансовым отчётам
  • Поиск по длинным документам до 32 тыс. токенов
Размеры
0.6B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответовRU2025–2026

POLLUX Judge (ai-forever)

SberDevices (ai-forever) · Россия

Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.

  • Автоматическая проверка качества ответов чат-бота на русском
  • Сравнение нескольких моделей перед выбором
  • Контроль ответов после дообучения
Размеры
4B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025–2026

Goedel-Prover

Принстонский университет · США

Открытые модели для формальных доказательств в Lean 4 из Принстона. Свежая Goedel-Code-Prover доказывает корректность программ.

  • Формальная проверка математических выкладок
  • Проверка корректности кода
  • Обучение
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGGGUF2026

pplx-embed

Perplexity · США

Эмбеддинги поискового сервиса Perplexity. Есть версии, которые учитывают контекст всего документа, а не только отдельного фрагмента.

  • Поиск по большим массивам документов
  • RAG с учётом контекста документа
  • Поиск по сайту и каталогу
Размеры
0.6B – 4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голос: спикеры и звукRU2026

FireRedVAD

FireRedTeam (Xiaohongshu) · Китай

Детектор речи и звуковых событий: отличает речь, пение и музыку. В тесте на 102 языках (набор FLEURS, русский входит) обошёл Silero VAD и TEN VAD. Есть потоковый режим.

  • Нарезка записей перед распознаванием речи
  • Отделение речи от музыки и пения в эфирах и роликах
  • Определение речи в голосовых ботах
Размеры
компактная, точный размер не указан
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRU2026

Harrier (harrier-oss)

Microsoft · США

Многоязычные эмбеддинги Microsoft 2026 года с контекстом до 32 тыс. токенов, русский в списке языков. Версии 270M и 0.6B идут на обычном сервере, 27B — самая точная.

  • Поиск по базе знаний на разных языках
  • Подбор фрагментов для RAG
  • Поиск по длинным документам
Размеры
270M – 27B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2024–2026

Qwen Coder

Alibaba (команда Qwen) · Китай

Самая широкая открытая линейка для кода: от 0.5B для автодополнения до 480B для агентов. Qwen3-Coder-Next (80B, активны 3B) работает как агент-разработчик на одной видеокарте.

  • Автодополнение кода в редакторе
  • Агент, который сам правит код в репозитории
  • Генерация и доработка скриптов, SQL, интеграций
Размеры
0.5B – 480B-A35B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодGGUF2026

IQuest-Coder

IQuest Research · Китай

Семейство моделей для кода с обычными и рассуждающими версиями, в том числе вариант Loop с повторным проходом по слоям. Размеры от 7B до 40B.

  • Генерация и доработка кода
  • Решение задач с пошаговыми рассуждениями
  • Агентная работа с репозиторием
Размеры
7B – 40B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Код2026

SERA (Ai2 Open Coding Agents)

Ai2 (Allen Institute for AI) · США

Полностью открытые агенты-разработчики от Ai2: открыты веса, данные и рецепт обучения. Задуманы так, чтобы компания могла дешево доучить агента на своём репозитории.

  • Агент для исправления задач в коде
  • Дообучение агента под внутренний репозиторий
  • Автоматизация мелких правок и тестов
Размеры
8B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голосовые ассистенты2024–2026

Moshi / Hibiki

Kyutai · Франция

Голосовой ассистент, который слушает и говорит одновременно, без задержки на распознавание и синтез. Hibiki — синхронный перевод речи в речь между несколькими европейскими языками.

  • Голосовой собеседник в реальном времени
  • Синхронный перевод речи
  • Голосовые интерфейсы без задержки
Размеры
2B – 7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Голосовые ассистентыGGUF2025–2026

MiniCPM-o

OpenBMB (ModelBest, Университет Цинхуа) · Китай

Небольшая модель, которая видит, слышит и отвечает голосом в реальном времени, может клонировать голос. Голосовой диалог на английском и китайском, текст — на 30+ языках.

  • Голосовой ассистент на своём сервере
  • Разбор видео и документов
  • Ответы голосом по картинке с камеры
Размеры
8B – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютера2025–2026

GUI-Owl / Mobile-Agent

Alibaba (Tongyi Lab, X-PLUG) · Китай

Модели для управления телефоном и компьютером из проекта Mobile-Agent: работают с Android, Windows, macOS и браузером, в версии 1.5 есть режим с рассуждением.

  • Автоматизация действий в мобильных приложениях
  • Работа в настольных программах без API
  • Тестирование приложений по сценарию
Размеры
2B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2025–2026

Qwen3 Embedding / Reranker

Alibaba (Qwen) · Китай

Эмбеддинги и реранкеры на базе Qwen3, в числе лучших открытых для многоязычного поиска, включая русский. VL-версии ищут по картинкам, скриншотам и видео.

  • Поиск по базе знаний для RAG
  • Переранжирование найденного перед ответом
  • Поиск по сканам, слайдам и скриншотам
Размеры
0.6B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAG2026

Voyage 4 nano

Voyage AI (MongoDB) · США

Единственная открытая модель линейки Voyage 4: её векторы совместимы с платными старшими версиями, можно начать локально и позже перейти на API.

  • Поиск по документам на своём сервере
  • RAG для небольших баз знаний
  • Поиск похожих текстов
Размеры
около 340M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Phi

Microsoft · США

Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.

  • Ассистент на ноутбуке или своём сервере
  • Задачи с рассуждением и расчётами
  • Разбор изображений и схем (vision-версии)
Размеры
1.3B – 42B-A6.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2024–2026

INTELLECT

Prime Intellect · США

Модели, обученные распределённо на видеокартах со всего мира. INTELLECT-3 на 106B дообучена с подкреплением для математики, кода и агентов.

  • Задачи с рассуждением и математикой
  • Помощь в программировании
  • Агенты с вызовом инструментов
Размеры
10B – 106B-A12B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Агенты для компьютераGGUF2026

EvoCUA

Meituan · Китай

Агент Meituan для управления компьютером, обученный на большом числе смоделированных задач в настольных программах. На выходе даёт клики и ввод с клавиатуры.

  • Работа в офисных и старых программах без API
  • Перенос данных между системами
  • Прогон сценариев для тестов
Размеры
8B – 32B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Кибербезопасность2025–2026

Foundation-Sec

Cisco (Foundation AI) · США

Модели Cisco для информационной безопасности на базе Llama 3.1 8B: разбор уязвимостей, угроз и инцидентов. Можно развернуть внутри периметра.

  • Разбор отчётов об уязвимостях и угрозах
  • Помощь аналитику SOC при инцидентах
  • Сопоставление угроз с MITRE ATT&CK
Размеры
8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Голос: спикеры и звукRU2025–2026

Smart Turn

Daily (Pipecat) · США

Определяет по интонации, закончил ли человек мысль или просто сделал паузу, чтобы голосовой бот не перебивал. Версия 3 весит 8 МБ, работает на процессоре и понимает 23 языка, включая русский.

  • Голосовой бот не перебивает клиента на паузах
  • Быстрый ответ, когда клиент действительно договорил
  • Дополнение к обычному детектору речи в голосовых ассистентах
Размеры
8M (v3) – 580M (v1)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодRUOllama2025

Devstral

Mistral AI (с All Hands AI) · Франция

Модели Mistral для агентной разработки: сами читают репозиторий, правят файлы и запускают команды. Версия 24B помещается на одну видеокарту.

  • Агент-разработчик для исправления задач из трекера
  • Доработка внутренних систем по описанию
  • Автоматизация рутинных правок в коде
Размеры
24B – 123B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Агенты для компьютера2023–2025

CogAgent / AutoGLM

Zhipu AI (Z.ai) и Университет Цинхуа · Китай

Одна из первых открытых моделей для управления интерфейсом по скриншоту, развитие — AutoGLM-Phone для работы в приложениях смартфона на Android.

  • Автоматизация действий в мобильных приложениях
  • Работа в веб-интерфейсах без API
  • Тестирование приложений по сценарию
Размеры
9B – 18B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Агенты для компьютераGGUF2025

MAI-UI

Alibaba (Tongyi-MAI) · Китай

Компактные модели Alibaba для работы в интерфейсе смартфона и компьютера: находят элементы и выполняют многошаговые задачи. Малый размер позволяет запуск на обычной видеокарте.

  • Автоматизация действий в мобильных приложениях
  • Работа в программах без API
  • Автотесты интерфейсов
Размеры
2B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Модерация и безопасность2025

AprielGuard

ServiceNow · США

Guard-модель, которая ловит и опасный контент, и атаки на ИИ (prompt injection, джейлбрейки), в том числе в работе агентов с инструментами.

  • Проверка запросов к чат-боту на атаки и взлом
  • Фильтр опасных ответов модели
  • Контроль действий ИИ-агента с инструментами
Размеры
8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данныеGGUF2024–2025

TableGPT2 / TableGPT-R1

Чжэцзянский университет · Китай

Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.

  • Ответы на вопросы по таблицам и выгрузкам
  • Автоматический разбор данных с написанием кода
  • Помощник в BI и внутренней отчётности
Размеры
7B – 72B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстOllama2023–2025

Hermes

Nous Research · США

Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.

  • Агенты, вызывающие функции и API
  • Извлечение данных в строгом формате JSON
  • Ассистент с гибкой настройкой роли и тона
Размеры
3B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Голос: спикеры и звукRU2020–2025

Silero VAD

Silero · Россия

Самый популярный открытый детектор речи: отличает голос от тишины и шума. Обрабатывает фрагмент звука меньше чем за миллисекунду на одном ядре процессора, обучен на записях более чем 6000 языков.

  • Нарезка звонков и записей перед распознаванием речи
  • Определение, когда клиент говорит, в голосовом боте
  • Отсев тишины и шума, экономия на расшифровке
Размеры
около 2 МБ
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2025

Cogito

Deep Cogito · США

Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.

  • Чат-ассистент с режимом рассуждений
  • Написание кода и вызов инструментов
  • Ответы на сложные вопросы по документам
Размеры
3B – 671B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Реранкеры2025

zerank (ZeroEntropy)

ZeroEntropy · США

Реранкеры на базе Qwen3. В карточке перечислены рабочие области — финансы, право, код, медицина, наука; язык указан английский.

  • Уточнение выдачи перед ответом ИИ-помощника
  • Сортировка результатов поиска по договорам и отчётам
  • Поиск по технической и научной документации
Размеры
zerank-2 — 4B (на базе Qwen3-4B), есть уменьшенная версия small
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2025

mxbai (Mixedbread Embed и Rerank)

Mixedbread · Германия

Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.

  • Поиск по базе знаний
  • Переранжирование результатов перед ответом бота
  • Поиск по каталогу товаров
Размеры
17M – 1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск по сканам документов2025

ModernVBERT / ColModernVBERT

Illuin Technology, EPFL, CentraleSupélec · Франция

Компактная (250M) модель для поиска по страницам документов как по картинкам. По данным авторов, не уступает моделям в 10 раз крупнее и работает без видеокарты.

  • Поиск по сканам и PDF на слабом сервере
  • Индексация архивов документов
  • Поиск по слайдам и инструкциям
Размеры
250M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGOllama2025

EmbeddingGemma

Google · США

Маленькая многоязычная модель эмбеддингов на базе Gemma 3, работает даже на телефоне и ноутбуке без интернета.

  • Поиск по документам на устройстве
  • RAG без отправки данных наружу
  • Классификация текстов
Размеры
300M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGOllama2023–2025

BGE (BAAI General Embedding)

BAAI (Пекинская академия ИИ) · Китай

Одни из самых популярных эмбеддингов для поиска и RAG. Основные версии v1.5 рассчитаны на английский и китайский; для русского у BAAI есть отдельная bge-m3.

  • Поиск по документам на английском
  • Подбор фрагментов для ответа чат-бота (RAG)
  • Поиск по коду (bge-code)
Размеры
24M – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLGGUF2024–2025

Prem-1B-SQL

Prem AI · Великобритания

Модель текст-в-SQL всего на 1B параметров: задумана для локального запуска, чтобы база данных не уходила во внешние сервисы.

  • Локальный перевод вопросов в SQL без выхода в интернет
  • Подсказки по запросам на слабом железе
  • Встраивание в внутренние инструменты аналитики
Размеры
1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2025

gpt-oss

OpenAI · США

Первые открытые модели OpenAI со времён GPT-2. Рассуждения, вызов инструментов, младшая версия помещается на одну видеокарту.

  • ИИ-агент с вызовом внутренних систем
  • Ответы по регламентам
  • Черновики писем и отчётов
Размеры
20B, 120B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Kimina-Prover

Moonshot AI и Project Numina · Китай, Франция

Модели для формальных доказательств в Lean 4 от Moonshot AI (Kimi) и Numina. Есть маленькие версии от 0.6B, которые запускаются на ноутбуке.

  • Формальная проверка математических выкладок
  • Перевод задачи с обычного языка на Lean
  • Обучение и олимпиадная подготовка
Размеры
0.6B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025

Seed-OSS

ByteDance · Китай

Открытая модель ByteDance на 36B с контекстом до 512 тыс. токенов и настраиваемым «бюджетом размышлений». Помещается на одну мощную видеокарту.

  • Разбор длинных документов
  • Агенты с инструментами
  • Корпоративный ассистент
Размеры
36B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Текст2024–2025

Grok (открытые веса)

xAI · США

xAI выкладывает веса прошлых поколений Grok. Модели очень большие и требуют кластера видеокарт, поэтому на практике их запускают редко.

  • Исследования больших моделей
  • Ассистент на собственной инфраструктуре
  • Генерация и анализ текстов
Размеры
314B (Grok-1), Grok-2 крупнее
Железо
от: Кластер
Коммерция с условиямиПодробнее
Голос: спикеры и звук2025

TEN VAD

Agora (проект TEN) · США / Китай

Лёгкий детектор речи для голосовых ассистентов в реальном времени: быстрее замечает начало и конец фразы, чем Silero VAD. Работает на сервере, телефоне и в браузере.

  • Определение речи в голосовом боте без задержек
  • Быстрая реакция ассистента на конец фразы
  • Работа в мобильных приложениях и браузере
Размеры
очень малая, библиотека меньше Silero VAD
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияOllama2025

DeepScaleR, DeepCoder, DeepSWE

Agentica (Беркли, Sky Computing Lab) и Together AI · США

Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.

  • Решение математических задач с пошаговым выводом
  • Генерация и проверка кода
  • Агент для исправления ошибок в репозитории
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск по сканам документов2024–2025

ColPali / ColQwen

Illuin Technology (команда ViDoRe) · Франция

Поиск по PDF и сканам как по картинкам: страницу не нужно распознавать, модель сразу находит нужную по вопросу, включая таблицы и схемы. Обучены на английском.

  • Поиск по сканам, презентациям и PDF
  • RAG по документам с таблицами и графиками
  • Поиск по технической документации
Размеры
256M – 3B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Проверка фактов и оценка ответов2024–2025

CompassJudger / CompassVerifier

OpenCompass (Шанхайская лаборатория ИИ) · Китай

Линейка судей от команды открытых тестов моделей: оценивают ответы и сверяют их с эталоном. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.

  • Оценка ответов моделей по заданным критериям
  • Сверка ответа с эталонным решением
  • Сравнение нескольких моделей на своих данных
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассуждения2025

AceMath / AceReason

NVIDIA · США

Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Разбор задач по программированию
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Проверка фактов и оценка ответов2024–2025

Skywork-Reward

Skywork (Kunlun Tech) · Китай

Модели-оценщики: ставят балл ответу языковой модели, насколько он хорош для пользователя. Нужны для дообучения своих моделей и отбора лучшего из нескольких ответов.

  • Выбор лучшего из нескольких ответов бота
  • Оценка качества ответов при дообучении модели
  • Сравнение моделей перед внедрением
Размеры
0.6B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КибербезопасностьGGUF2023–2025

SecGPT

Clouditera · Китай

Китайское открытое семейство для кибербезопасности: разбор уязвимостей, анализ логов и трафика, объяснение команд и скриптов.

  • Разбор уязвимостей и подготовка рекомендаций по исправлению
  • Анализ логов и восстановление цепочки атаки
  • Объяснение подозрительных команд и скриптов
Размеры
1.5B – 14B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КибербезопасностьGGUF2025

Trendyol Cybersecurity LLM

Trendyol · Турция

Модели безопасности от крупного турецкого маркетплейса, выложены в формате GGUF: разбор алертов и инцидентов, английский и турецкий языки.

  • Разбор алертов и первичная оценка инцидента
  • Объяснение подозрительной активности в отчётах
  • Помощь дежурной смене центра мониторинга
Размеры
32B и 70B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Текст в SQLGGUF2025

SQL-R1

IDEA Research · Китай

Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.

  • Запросы к базе по вопросам с несколькими условиями
  • Разбор и исправление чужих SQL-запросов
  • Помощник аналитика в BI-системе
Размеры
3B – 14B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2025

DeepSeek-R1

DeepSeek · Китай

Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.

  • Сложные расчёты и проверка логики
  • Анализ договоров и регламентов
  • Помощь программистам
Размеры
1,5B – 671B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодGGUF2025

Seed-Coder

ByteDance Seed · Китай

Компактная модель для кода 8B от ByteDance: базовая, инструктивная и рассуждающая версии. Данные для обучения отбирала сама модель, почти без ручных правил.

  • Автодополнение и генерация кода
  • Решение алгоритмических задач
  • Основа для дообучения под свой стек
Размеры
8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2025

BAGEL

ByteDance Seed · Китай

Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.

  • Редактирование фото в диалоге
  • Ответы на вопросы по изображению
  • Генерация картинок с пояснениями
Размеры
14B-A7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Разбор текстаRU2023–2025

RuModernBERT и USER (deepvk)

deepvk (VK) · Россия

Русские энкодеры от команды VK: RuModernBERT читает длинные тексты, USER даёт векторы для поиска, GeRaCl классифицирует тексты по темам без обучения.

  • Классификация обращений без размеченных данных
  • Поиск по базе знаний на русском
  • Разбор длинных договоров
Размеры
35M – 360M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQL2025

Arctic-Text2SQL-R1

Snowflake · США

Модель Snowflake для перевода вопросов в SQL, обученная с подкреплением на проверке результата запроса. Открыта версия 7B на базе Qwen2.5-Coder.

  • Вопросы к хранилищу данных на обычном языке
  • Генерация SQL для отчётов и дашбордов
  • Проверка и исправление запросов аналитиков
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодRU2025

Kodify-Nano (МТС AI)

МТС AI (MWS AI) · Россия

Маленький помощник программиста от МТС AI, понимает запросы на русском. Работает локально, есть плагины для VS Code и JetBrains.

  • Подсказки и дописывание кода в редакторе
  • Объяснение кода на русском
  • Черновики тестов и документации
Размеры
1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Реранкеры2023–2025

ColBERT (поиск с поздним взаимодействием)

Stanford NLP, затем Answer.AI и LightOn · США и Франция

Другой принцип поиска: каждое слово вопроса сравнивается с каждым словом документа, а не два текста целиком. Индекс получается тяжелее обычных эмбеддингов. В карточках заявлен английский язык.

  • Поиск по базе знаний с длинными документами
  • Переупорядочивание найденных фрагментов
  • Поиск по регламентам и технической документации
Размеры
около 33M – 150M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Проверка фактов и оценка ответовRU2024–2025

Nemotron Reward / GenRM

NVIDIA · США

Крупные оценщики NVIDIA для отбора и дообучения ответов. У мультиязычной версии GenRM в списке языков есть русский. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.

  • Отбор лучшего ответа из нескольких вариантов
  • Подготовка данных для дообучения своей модели
  • Оценка ответов помощника на русском и других языках
Размеры
49B, 70B и 340B
Железо
от: Кластер
Коммерция с условиямиПодробнее
Прогнозы2025

Sundial

THUML, Университет Цинхуа · Китай

Модель прогнозов, которая выдаёт не одну линию, а набор возможных сценариев — удобно, когда нужен коридор спроса или нагрузки, а не одно число.

  • Прогноз спроса с коридором значений
  • Планирование запасов с учётом разброса
  • Прогноз нагрузки на сервисы и персонал
Размеры
128M (sundial-base)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2025

Llama

Meta · США

Модели, с которых начался массовый open source в ИИ. Огромная экосистема дообученных версий и инструментов.

  • Ассистент для сотрудников
  • Суммаризация встреч и документов
  • Основа для дообучения под отрасль
Размеры
1B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияGGUF2024–2025

DeepSeek-Prover

DeepSeek · Китай

Модели DeepSeek для формальных доказательств на языке Lean 4: доказательство проверяет программа, а не человек. Узкий инструмент для математиков и инженеров.

  • Формальная проверка математических выкладок
  • Проверка корректности алгоритмов
  • Обучение и олимпиадная подготовка
Размеры
7B – 671B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Модерация и безопасность2024–2025

Prompt Guard

Meta · США

Крошечные классификаторы, которые ловят попытки взломать бота: промпт-инъекции и обход правил. Версия 86M многоязычная, 22M только английский.

  • Защита бота от промпт-инъекций
  • Проверка писем и документов, которые попадают в ИИ-агента
  • Быстрый фильтр перед большой моделью
Размеры
22M – 86M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Агенты для компьютераGGUF2025

UI-TARS

ByteDance Seed · Китай

Модель, которая смотрит на скриншот и сама двигает мышью и клавиатурой: кликает, заполняет поля, переходит по меню. Открыты 1-е поколение и 1.5-7B; UI-TARS-2 весов не открыл.

  • Работа в старых программах без API
  • Заполнение форм и перенос данных между системами
  • Автотесты интерфейсов по сценарию на обычном языке
Размеры
2B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQL2025

XiYanSQL-QwenCoder

Alibaba · Китай

Модели Alibaba для перевода вопросов в SQL на базе Qwen2.5-Coder. Работают с разными диалектами SQL, есть малая версия 3B для слабого железа.

  • Вопросы к базе на обычном языке
  • Запросы к разным СУБД (PostgreSQL, MySQL, SQLite)
  • Автоматизация типовых отчётов
Размеры
3B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КибербезопасностьGGUF2023–2025

WhiteRabbitNeo / DeepHat

Kindo · США

Одно из самых известных открытых семейств для задач безопасности и DevSecOps: разбор кода на уязвимости, сценарии проверок, объяснение атак.

  • Поиск слабых мест в коде и конфигурациях
  • Разбор инцидентов и объяснение техник атак
  • Черновики скриптов и регламентов для команды безопасности
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КартинкиGGUF2024–2025

SANA

NVIDIA · США

Быстрая модель картинок от NVIDIA: 4K-изображения за секунды и работа даже на ноутбучной видеокарте. Версия Sprint генерирует в 1–2 шага.

  • Массовая генерация картинок
  • Визуалы высокого разрешения
  • Генерация в реальном времени в приложениях
Размеры
0.6B – 4.8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2025

Nomic Embed

Nomic AI · США

Полностью открытые эмбеддинги — с весами, данными и кодом обучения. v2 многоязычная на MoE, есть версии для кода и для поиска по PDF-страницам.

  • Поиск по документам и базе знаний
  • Поиск по коду
  • Поиск по сканам и PDF без распознавания
Размеры
137M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRUGGUF2023–2025

Piper

Rhasspy / Open Home Foundation · США

Очень быстрый синтез речи, который работает даже на Raspberry Pi. Готовые голоса на 35+ языках, есть несколько русских.

  • Озвучка уведомлений и ответов бота
  • Голос для устройств без интернета
  • Голосовые меню
Размеры
около 5M – 30M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Синтез речиGGUF2025

Orpheus TTS

Canopy Labs · США

Синтез речи на основе языковой модели с живыми интонациями и эмоциональными вставками. Быстро отвечает, подходит для голосовых ассистентов. В основном английский.

  • Голос для ассистента в реальном времени
  • Эмоциональная озвучка
  • Клонирование голоса
Размеры
3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиGGUF2025

Sesame CSM

Sesame · США

Модель разговорной речи, которая учитывает контекст беседы и звучит как живой собеседник. Только английский.

  • Голос для разговорного ассистента
  • Озвучка диалогов
  • Прототипы голосовых продуктов
Размеры
1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQL2025

OmniSQL

Renmin University of China (RUC) · Китай

Модели для перевода вопросов в SQL, обученные на миллионах синтетических примеров запросов к разным базам. Три размера под разное железо.

  • Вопросы к базе данных без знания SQL
  • Генерация запросов для отчётов
  • Основа для дообучения под свою схему базы
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютера2024–2025

xLAM

Salesforce · США

Модели Salesforce для вызова функций и работы агентов: выбирают нужный инструмент и заполняют его параметры. Сильны в тестах, но лицензия некоммерческая.

  • Вызов API и внутренних сервисов по запросу пользователя
  • Агенты с несколькими шагами и инструментами
  • Сравнение подходов перед выбором коммерческой модели
Размеры
1B – 8x22B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Компьютерное зрение2023–2025

SigLIP (наследник CLIP)

Google · США

Модели, которые переводят картинки и текст в общее пространство: можно искать фото по словам и классифицировать изображения без обучения. CLIP от OpenAI (2021) — предшественник.

  • Поиск картинок по текстовому запросу
  • Автоматическая разметка и теги каталога
  • Фильтрация недопустимого контента
Размеры
около 0.2B – 2B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиGGUF2024–2025

Kokoro

hexgrad (независимый разработчик) · не указана

Крошечная модель синтеза речи (82M), которая звучит на уровне крупных. Работает на обычном процессоре; английский и ещё несколько языков, русского нет.

  • Озвучка статей и уведомлений
  • Голос для приложений без видеокарты
  • Массовая озвучка текстов
Размеры
82M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Агенты для компьютера2024–2025

OmniParser

Microsoft · США

Разбирает скриншот на кнопки, поля и иконки с подписями, чтобы обычная языковая модель понимала экран и могла им управлять. Сам не кликает, а служит «глазами» агента.

  • Разметка экранов старых программ для автоматизации
  • Подготовка агента к работе в интерфейсе
  • Проверка, что на экране есть нужные элементы
Размеры
менее 1B (детектор + подписи)
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Агенты для компьютераGGUF2025

Magma

Microsoft Research · США

Модель-агент, которая одинаково планирует действия и в интерфейсе (кнопки на экране), и для робота (движения манипулятора). Пока скорее исследовательская база, чем готовый продукт.

  • Пилоты по управлению интерфейсом
  • Исследовательские проекты на стыке экрана и робототехники
  • Разбор скриншотов с планом действий
Размеры
8B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Поиск и RAGRU2023–2025

GTE

Alibaba · Китай

Эмбеддинги и реранкеры Alibaba для поиска: от крошечных до 7B на базе Qwen2. Есть многоязычная версия mGTE с длинным контекстом.

  • Смысловой поиск по документам
  • Переранжирование результатов поиска
  • Кластеризация и классификация текстов
Размеры
33M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаGGUF2024–2025

ModernBERT

Answer.AI и LightOn · США / Франция

Современная замена классическому BERT: быстрее, читает до 8 тысяч токенов за раз. Основа для своих классификаторов. Обучена на английском и коде, для русского есть RuModernBERT.

  • Классификация обращений и документов
  • Поиск нужных фрагментов в длинных текстах
  • Основа для своего классификатора после дообучения
Размеры
150M – 395M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2019–2025

Sentence Transformers (all-MiniLM, paraphrase-multilingual)

UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия

Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.

  • Поиск по базе знаний и FAQ
  • Поиск похожих обращений и дублей
  • Группировка отзывов и заявок по темам
Размеры
около 20M – 470M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUOllama2024–2025

ReaderLM (Jina)

Jina AI · Германия

Маленькие модели, которые превращают сырой HTML веб-страниц в чистый Markdown или JSON. Удобно готовить сайты для базы знаний. Лицензия только некоммерческая.

  • Очистка страниц сайтов для базы знаний
  • Извлечение данных со страниц в JSON
  • Подготовка текстов для RAG
Размеры
0.5B – 1.5B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Проверка фактов и оценка ответов2025

Atla Selene

Atla · Великобритания

Модель-судья на 8B: оценивает ответ другой модели по вашим критериям и пишет обоснование. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.

  • Оценка ответов чат-бота по своим критериям
  • Сравнение двух версий подсказки или модели
  • Отбраковка слабых ответов перед отправкой человеку
Размеры
8B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Поиск и RAGRUOllama2024

Snowflake Arctic Embed

Snowflake · США

Эмбеддинги от Snowflake, заточенные именно под поиск. Версия 2.0 многоязычная (русский в списке языков), держит длинные тексты до 8 тыс. токенов и умеет сжимать векторы.

  • Поиск по документам и базе знаний
  • Подбор фрагментов для RAG
  • Поиск по отчётам и внутренним данным
Размеры
22M – 568M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск по сканам документов2024

GME (General Multimodal Embedding)

Alibaba (Tongyi Lab) · Китай

Один вектор и для текста, и для картинки, и для их пары: одной моделью можно искать товар по фото, страницу документа по вопросу и картинку по описанию. Языки в карточке: английский и китайский.

  • Поиск товара по фотографии
  • Поиск по каталогу картинок и карточек
  • Поиск по страницам документов как по изображениям
Размеры
2B и 7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Проверка фактов и оценка ответов2024

GLIDER (Patronus)

Patronus AI · США

Небольшой судья: ставит оценку по вашим критериям и показывает, какой кусок ответа к ней привёл. Лицензия некоммерческая. Судья сам ошибается и ручную проверку не заменяет.

  • Оценка ответов по своим критериям с пояснением
  • Разбор, за что снижена оценка
  • Массовая проверка диалогов помощника
Размеры
3.8B (на базе Phi-3.5-mini)
Железо
от: Ноутбук
Только некоммерческоеПодробнее
КодOllama2024

OpenCoder

INF Technology · Китай

Полностью воспроизводимые модели для кода: вместе с весами открыты данные, конвейер их очистки и рецепт обучения. Понимают английский и китайский.

  • Генерация и дополнение кода
  • Обучение своей модели для кода по открытому рецепту
  • Ассистент программиста на слабом железе
Размеры
1.5B – 8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024

Athene

Nexusflow · США

Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.

  • Исследование агентов и вызова функций
  • Сравнение с коммерческими моделями
  • Эксперименты с чат-ассистентом
Размеры
70B – 72B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Поиск по сканам документов2024

MonoQwen2-VL (LightOn)

LightOn · Франция

Реранкер для страниц-картинок: после визуального поиска переставляет найденные страницы по тому, насколько они отвечают на вопрос. Языки в карточке не указаны.

  • Уточнение выдачи поиска по сканам и PDF
  • Отбор страниц перед ответом ИИ-помощника
  • Сортировка найденных слайдов и отчётов
Размеры
2B (на базе Qwen2-VL)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Прогнозы2024

MOMENT

Auton Lab, Университет Карнеги — Меллона · США

Базовая модель для рядов чисел: один движок используют и для прогноза, и для поиска аномалий, и для заполнения пропусков, и для классификации.

  • Прогноз спроса и загрузки
  • Поиск аномалий в показаниях датчиков и метриках
  • Заполнение пропусков в исторических данных
Размеры
около 40M – 385M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Прогнозы2024

Granite Time Series (TinyTimeMixers, PatchTST)

IBM Research · США

Крошечные модели прогнозов от IBM: считаются на обычном процессоре, их ставят рядом с бизнес-системой без отдельного сервера с видеокартой.

  • Прогноз продаж и остатков на складе
  • Прогноз энергопотребления и нагрузки оборудования
  • Быстрые прогнозы прямо на сервере компании
Размеры
очень маленькие: у TinyTimeMixers около 1M параметров
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2023–2024

DeepSeek-Coder

DeepSeek · Китай

Линейка моделей для кода от DeepSeek: от маленьких для автодополнения до большой MoE V2, которая в 2024 году была на уровне закрытых моделей. Позже код ушёл в общие модели DeepSeek.

  • Автодополнение и генерация кода
  • Перевод кода между языками
  • Поиск ошибок и объяснение чужого кода
Размеры
1.3B – 236B-A21B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КодOllama2024

Yi-Coder

01.AI · Китай

Модели для кода от 01.AI на 1.5B и 9B с контекстом 128 тыс. токенов и поддержкой 52 языков программирования. Отдельная линейка рядом с текстовыми Yi.

  • Автодополнение и генерация кода
  • Объяснение и рефакторинг кода
  • Ассистент программиста без облака
Размеры
1.5B – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответов2024

Flow Judge

Flow AI · не раскрыта

Маленькая модель-судья: проверяет ответ по вашей инструкции и ставит оценку с пояснением. Помещается на скромный сервер. Судья сам ошибается и ручную проверку не заменяет.

  • Проверка ответов ИИ-помощника на соответствие инструкции
  • Массовая оценка выгрузки диалогов
  • Контроль качества перед выкаткой изменений
Размеры
3.8B (на базе Phi-3.5-mini)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Прогнозы2024

Time-MoE

Команда Time-MoE · не раскрыта

Модель прогнозов с разреженной архитектурой: на каждом шаге работает лишь часть сети, поэтому она остаётся быстрой при небольшом размере.

  • Прогноз продаж и остатков
  • Прогноз нагрузки на сервисы и персонал
  • Планирование закупок по истории
Размеры
50M и 200M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023–2024

StableLM и Stable Code

Stability AI · Великобритания

Малые модели Stability AI: StableLM 2 на 1.6B знает 7 европейских языков, Stable Code на 3B дописывает код. Обновлений с 2024 года нет.

  • Лёгкий чат-бот на обычном ПК
  • Автодополнение кода в редакторе
  • Основа для дообучения под свою задачу
Размеры
1.6B – 12B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КодOllamaНе развивается2024

Codestral

Mistral AI · Франция

Модель Mistral для кода на 80+ языках программирования. Открытые веса основной версии нельзя использовать в работе без платной лицензии; новые версии Codestral только по API.

  • Оценка и тесты перед покупкой лицензии
  • Автодополнение кода (при коммерческой лицензии)
  • Исследование качества моделей для кода
Размеры
7B – 22B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Разбор текстаRUНе развивается2020–2024

ruBERT, ruRoBERTa, ruELECTRA (ai-forever)

SberDevices (ai-forever) · Россия

Русскоязычные энкодеры Сбера, обученные на больших русских корпусах. Основа для классификаторов, NER и поиска по смыслу на русском.

  • Классификация обращений на русском
  • Извлечение имён, сумм и дат после дообучения
  • Определение тональности отзывов
Размеры
около 30M – 430M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllamaНе развивается2023–2024

CodeGeeX

Zhipu AI (Z.ai) и Университет Цинхуа · Китай

Модели для кода от создателей GLM. CodeGeeX4-ALL-9B на базе GLM-4-9B в одной модели совмещает автодополнение, чат по коду, вызов функций и поиск по репозиторию.

  • Автодополнение кода в IDE
  • Чат-помощник по коду
  • Ответы на вопросы по репозиторию
Размеры
6B – 9B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
РеранкерыGGUFНе развивается2023–2024

BGE Reranker

BAAI (Пекинская академия ИИ) · Китай

Реранкеры: берут найденные поиском фрагменты и переставляют их по реальной близости к вопросу. Версия v2-m3 многоязычная и лёгкая, её часто ставят в пару к bge-m3.

  • Уточнение выдачи перед ответом чат-бота
  • Сортировка результатов поиска по базе знаний
  • Отбор самых подходящих пунктов договоров и регламентов
Размеры
278M – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответовНе развивается2024

Patronus Lynx

Patronus AI · США

Проверяет, не придумал ли чат-бот факт, которого нет в исходных документах. Лицензия некоммерческая. Проверяющая модель сама ошибается и ручную проверку на важных задачах не заменяет.

  • Поиск выдуманных фактов в ответах ИИ-помощника
  • Проверка ответов на опору в приложенных документах
  • Отбраковка ответов перед отправкой клиенту
Размеры
8B и 70B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
ТекстOllamaНе развивается2023–2024

OpenChat

OpenChat (Университет Цинхуа) · Китай

Дообучения Mistral 7B и Llama 3 8B по методу C-RLFT, которые в 2023–2024 годах догоняли ChatGPT-3.5 при размере 7–8B. Лёгкий универсальный ассистент для слабого сервера.

  • Чат-ассистент на недорогом сервере
  • Черновики писем и ответов
  • Помощь с простым кодом
Размеры
7B – 13B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст в SQLOllamaНе развивается2023–2024

SQLCoder

Defog · США

Одна из первых открытых моделей, которые переводят вопрос на обычном языке в SQL-запрос к базе. Есть в Ollama, но свежие конкуренты уже сильнее.

  • Ответы на вопросы менеджеров по базе продаж без аналитика
  • Черновики SQL-запросов для отчётов
  • Помощник внутри BI-системы
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Проверка фактов и оценка ответовНе развивается2024

ArmoRM (RLHFlow)

RLHFlow · США

Оценщик ответов, который выдаёт не один общий балл, а разбор сразу по нескольким признакам. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.

  • Отбор лучшего из нескольких вариантов ответа
  • Подготовка данных для дообучения модели
  • Оценка ответов помощника по нескольким признакам
Размеры
8B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
КодOllamaНе развивается2023–2024

StarCoder

BigCode (Hugging Face и ServiceNow) · США / Франция

Одна из первых открытых моделей для кода, обучена на открытом наборе исходников с возможностью исключить свой репозиторий. Сегодня скорее база для дообучения, чем лидер.

  • Автодополнение кода в редакторе
  • Дообучение на внутреннем коде компании
  • Генерация шаблонного кода и тестов
Размеры
1B – 15B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Проверка фактов и оценка ответовНе развивается2023–2024

Prometheus 2

KAIST и LG AI Research (prometheus-eval) · Южная Корея

Открытая модель-судья: оценивает ответы других моделей по вашим критериям и объясняет оценку. Замена платным моделям в роли проверяющего.

  • Оценка ответов чат-бота по своей шкале
  • Сравнение двух вариантов ответа
  • Проверка качества перед запуском ИИ-сервиса
Размеры
7B – 8x7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLGGUFНе развивается2024

Chat2DB-SQL

Chat2DB · Китай

Модель текст-в-SQL из открытого инструмента работы с базами Chat2DB: поддерживает разные диалекты SQL, карточка на английском и китайском.

  • Перевод вопроса в SQL внутри клиента базы данных
  • Черновики запросов под разные СУБД
  • Подсказки разработчику при работе со схемой
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023–2024

TinyLlama

TinyLlama (исследователи SUTD) · Сингапур

Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.

  • Простые чат-боты на слабом железе
  • Эксперименты и обучение команды
  • Основа для дообучения под узкую задачу
Размеры
1.1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КибербезопасностьGGUFНе развивается2023–2024

ZySec

ZySec AI · Индия

Небольшой открытый помощник для специалистов по безопасности: вопросы по стандартам, разбор угроз и уязвимостей, подготовка внутренних документов.

  • Ответы на вопросы по политикам и стандартам безопасности
  • Первичный разбор сообщений об угрозах
  • Черновики внутренних инструкций по защите
Размеры
2.8B и 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUНе развивается2022–2024

E5 / multilingual-e5

Microsoft · США

Проверенные модели для смыслового поиска. Многоязычные версии хорошо работают с русским и до сих пор служат надёжной основой для RAG.

  • Поиск по базе знаний и документам
  • Подбор ответов для чат-бота (RAG)
  • Поиск похожих обращений и дублей
Размеры
33M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLGGUFНе развивается2024

Natural-SQL

ChatDB · США

Модель текст-в-SQL на базе DeepSeek-Coder, рассчитанная на сложные вопросы с несколькими таблицами и условиями.

  • Сложные запросы с соединением нескольких таблиц
  • Ответы на вопросы по базе без аналитика
  • Черновики SQL для отчётов и выгрузок
Размеры
7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КодOllamaНе развивается2023–2024

Code Llama

Meta · США

Версия Llama 2, доученная на коде; есть варианты для Python и для диалога. Устарела, но много готовых дообученных версий и инструментов.

  • Автодополнение и объяснение кода
  • Генерация скриптов на Python
  • Базовая модель для дообучения под свой стек
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

WizardLM, WizardCoder, WizardMath

WizardLM (Microsoft и Пекинский университет) · США / Китай

Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.

  • Сложные многошаговые инструкции
  • Помощь программистам
  • Решение математических задач
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст в SQLOllamaНе развивается2024

DuckDB-NSQL

MotherDuck и Numbers Station · США

Модель для перевода вопросов в SQL, заточенная под встраиваемую аналитическую базу DuckDB. Есть в Ollama, удобна для локальной работы с CSV и Parquet.

  • Вопросы к выгрузкам CSV и Parquet на обычном языке
  • Запросы к DuckDB внутри аналитических скриптов
  • Быстрая аналитика на ноутбуке без сервера
Размеры
7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
РеранкерыGGUFНе развивается2023–2024

RankVicuna / RankLLaMA / RankZephyr (Castorini)

Университет Ватерлоо, группа Castorini · Канада

Реранкеры-языковые модели: получают сразу список найденных фрагментов и переставляют его целиком, а не оценивают фрагменты по одному. Тяжелее обычных реранкеров.

  • Переупорядочивание длинной выдачи поиска
  • Отбор источников для ответа ИИ-помощника
  • Исследовательские сравнения способов поиска
Размеры
7B – 13B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
РеранкерыНе развивается2023

BCEmbedding (Youdao)

NetEase Youdao · Китай

Пара «эмбеддинг плюс реранкер» для баз знаний. В карточке заявлены английский, китайский, японский и корейский — русского в списке языков нет.

  • Поиск по базе знаний и справочным материалам
  • Переупорядочивание найденных фрагментов
  • Подбор ответов для чат-бота поддержки
Размеры
около 280M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиНе развивается2023

StyleTTS 2

Колумбийский университет · США

Лёгкая модель синтеза английской речи с естественной интонацией. На её основе построены многие другие модели, например Kokoro.

  • Озвучка текстов на английском
  • Основа для дообучения своего голоса
  • Прототипы голосовых сервисов
Размеры
около 150M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст в SQLНе развивается2023

CodeS

RUCKBReasoning, Китайский народный университет · Китай

Ранняя линейка открытых моделей текст-в-SQL размером от 1B: есть варианты, дообученные под конкретные схемы баз данных.

  • Перевод вопроса сотрудника в SQL-запрос
  • Черновики запросов к хранилищу под отчёт
  • Встраивание в BI-панель как подсказчик
Размеры
1B – 15B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст в SQLGGUFНе развивается2023

NSQL

Numbers Station · США

Одна из первых открытых линеек текст-в-SQL, включая совсем маленькие версии от 350M, которые запускаются на обычном ПК.

  • Перевод вопроса в SQL по описанию таблиц
  • Подсказки при написании запросов
  • Локальный помощник аналитика без передачи данных наружу
Размеры
350M – 7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
РеранкерыRUНе развивается2022

Cross-Encoder MS MARCO (MiniLM, TinyBERT, mMARCO)

UKP Lab и сообщество Sentence Transformers · Германия

Самые скачиваемые открытые реранкеры: крошечная модель читает пару «вопрос — найденный фрагмент» и ставит оценку близости. Многоязычная версия mMARCO знает русский.

  • Переупорядочивание результатов поиска по базе знаний
  • Отбор фрагментов перед ответом чат-бота
  • Поиск дублей среди обращений и карточек товаров
Размеры
около 4M – 120M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUНе развивается2019–2022

XLM-RoBERTa

Meta · США

Классический многоязычный энкодер на 100 языков, включая русский. Основа многих моделей тональности, NER и эмбеддингов, в том числе BGE-M3.

  • Определение тональности отзывов на разных языках
  • Извлечение имён и организаций после дообучения
  • Классификация обращений
Размеры
270M – 10.7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUНе развивается2021

DeBERTa-v3 и mDeBERTa-v3

Microsoft · США

Проверенный временем энкодер, на котором построено множество классификаторов и NER-моделей (в том числе GLiNER). Многоязычная mDeBERTa-v3 понимает русский.

  • Классификация отзывов по тональности
  • Извлечение сущностей после дообучения
  • Проверка, следует ли вывод из текста
Размеры
70M – 435M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUНе развивается2021

rubert-tiny

Давид Дале (cointegrated) · Россия

Очень маленький русско-английский BERT, работает быстро на обычном процессоре. Есть готовые дообученные версии для тональности, токсичности и эмоций.

  • Определение тональности отзывов
  • Фильтр грубых сообщений в чате
  • Быстрая классификация обращений
Размеры
12M – 29M
Железо
от: Ноутбук
Можно в коммерциюПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение