ТекстOllama2023–2026
DeepSeek · Китай
Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.
- Ассистент для сотрудников на своём сервере
- Разбор длинных договоров и отчётов
- Агенты, которые работают с инструментами и API
- Размеры
- 7B – 1.6T-A49B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Shanghai AI Laboratory · Китай
Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.
- Помощник исследователя: статьи, формулы, данные
- Разбор научных и технических документов
- Корпоративный чат на малых моделях
- Размеры
- 1.8B – около 1T
- Железо
- от: Ноутбук
ТекстRUOllama2024–2026
Cohere Labs · Канада
Многоязычные модели исследовательского крыла Cohere, от 23 до 100+ языков. Tiny Aya 2026 года на 3.3B работает на обычном ПК, но только некоммерчески.
- Перевод и переписка на редких языках
- Многоязычный чат-ассистент
- Разбор изображений с текстом (Vision)
- Размеры
- 3.3B – 35B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Alibaba · Китай
Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.
- Чат-бот и ассистент по базе знаний
- Ответы на письма и обращения
- Разбор и классификация документов
- Размеры
- 0,6B – 2,4T-A95B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Zhipu AI (Z.ai) · Китай
Одна из старейших китайских открытых линий: от ChatGLM-6B до GLM-5.3. Сильна в агентных задачах и программировании; GLM-5.3-Flash понимает картинки и выходит под MIT.
- Корпоративный чат-ассистент
- Агенты для рутинных офисных задач
- Помощь программистам
- Размеры
- 1.5B – 744B-A40B
- Железо
- от: Ноутбук
ТекстRUOllama2024–2026
Cohere · Канада
Модели для бизнеса: поиск по документам со ссылками на источники, вызов инструментов, много языков. Command A+ 2026 года впервые вышла под Apache 2.0, за ней — линейка North: код, перевод и компактное зрение.
- Ответы по базе знаний со ссылками на источники
- Агенты, работающие с внутренними системами
- Перевод и переписка на разных языках
- Размеры
- 2.5B – 218B-A25B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
NVIDIA · США
Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).
- Агенты с вызовом инструментов
- Задачи с рассуждением и расчётами
- Ответы по длинным документам
- Размеры
- 4B – 550B-A55B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
IBM · США
Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.
- Ответы по внутренним документам (RAG)
- Вызов инструментов и работа в агентах
- Извлечение данных и классификация
- Размеры
- 350M – 34B
- Железо
- от: Ноутбук
ТекстRUOllama2025–2026
Liquid AI · США
Модели новой архитектуры для работы прямо на устройстве: быстрые на обычном процессоре и в телефоне. Есть версии для извлечения данных, RAG и инструментов, а также LFM2.5-VL для картинок и голосовая LFM2.5-Audio.
- Ассистент на ноутбуке или телефоне без интернета
- Извлечение данных из документов
- Вызов инструментов в приложениях
- Размеры
- 230M – 24B-A2B
- Железо
- от: Ноутбук
ТекстOllama2026
Meta Superintelligence Labs · США
Открытая модель Meta для агентов на доступном железе: дистиллирована из закрытой Muse Spark, понимает текст и картинки, обучена на 100+ языках.
- Агенты с вызовом инструментов
- Разбор скриншотов, графиков и документов
- Многоязычный ассистент
- Размеры
- 30B
- Железо
- от: 1 видеокарта
КодOllama2026
DeepReinforce · не раскрыта
Модели для агентной разработки: сами строят план и обвязку под задачу и выполняют её в терминале. Дообучены на базе Qwen 3.5 и Gemma 4, работают с Claude Code, OpenHands и похожими инструментами.
- Агент-разработчик в терминале
- Исправление ошибок по описанию задачи
- Разбор и доработка большого репозитория
- Размеры
- 9B – 397B
- Железо
- от: 1 видеокарта
ТекстRUOllama2023–2026
Mistral AI · Франция
Европейские модели с упором на скорость. Mixtral — одна из первых открытых моделей на архитектуре «смесь экспертов»; есть версии с картинками (Pixtral, Medium 3.5), для доказательств в Lean и модерации (Shieldstral).
- Быстрые ответы в чате
- Извлечение данных из текста
- Перевод и работа с несколькими языками
- Размеры
- 3B – 675B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
LG AI Research · Южная Корея
Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.
- Корпоративный ассистент
- Работа с корейскими и английскими текстами
- Разбор документов и картинок (4.5)
- Размеры
- 1.2B – 750B-A37B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Upstage · Южная Корея
Модели корейской Upstage. Solar Open 2 рассчитана на офисную работу с документами: 250 млрд параметров, из них активны 15 млрд, языки — английский, корейский, японский.
- Работа с офисными документами
- Агенты для рутинных задач
- Помощь программистам
- Размеры
- 10.7B – 250B-A15B
- Железо
- от: 1 видеокарта
ТекстOllama2024–2026
Google · США
Компактные модели Google: хорошо работают на одном компьютере, старшие версии понимают картинки. Есть CodeGemma для кода, FunctionGemma 270M для вызова функций и быстрая DiffusionGemma.
- Ассистент на ноутбуке без интернета
- Разбор фото документов и чеков
- Классификация обращений
- Размеры
- 270M – 31B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025–2026
Open Thoughts (Стэнфорд, Беркли и другие университеты) · США
Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики регламентов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Картинка + текстOllama2024–2026
Moondream (M87 Labs) · США
Небольшая и быстрая модель зрения для продуктовых задач: ответы на вопросы, поиск и указание объектов, подписи. Moondream 3.1 — MoE на 9B с 2B активных.
- Поиск объектов и подсчёт на фото
- Проверка фото из полевых отчётов
- Подписи и теги для каталога
- Размеры
- 2B – 9B-A2B
- Железо
- от: Ноутбук
МедицинаOllama2023–2026
EPFL · Швейцария
Открытые медицинские модели швейцарского EPFL, которые дообучают поверх разных базовых моделей по клиническим руководствам. Не заменяет врача, решения принимает специалист.
- Ответы персоналу по клиническим руководствам
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 2B – 70B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Cognitive Computations (Эрик Хартфорд) · США
Дообучения без встроенной цензуры поверх Llama, Mistral, Qwen и других: модель выполняет почти любые запросы. Ответственность за фильтрацию и модерацию полностью на том, кто её внедряет, — без своего фильтра клиентам её не показывать.
- Ассистент, который не отказывает в законных, но «острых» темах
- Внутренние инструменты под жёстким системным промптом
- Ролевые и творческие сценарии
- Размеры
- 0.5B – 405B
- Железо
- от: Ноутбук
Картинка + текстOllama2023–2026
LLaVA / LMMs-Lab (исследователи из США и Китая) · США / Китай
Открытый проект, с которого пошла мода на модели «картинка + текст». Линейка OneVision понимает фото, документы и видео; открыты данные и рецепты обучения.
- Ответы на вопросы по фото и скриншотам
- Описание товаров по фотографии
- Разбор видео по кадрам
- Размеры
- 0.5B – 72B
- Железо
- от: Ноутбук
Картинка + текстOllama2024–2026
OpenBMB (ModelBest и Университет Цинхуа) · Китай
Компактные модели зрения, которые работают даже на телефоне и ноутбуке. Хорошо читают текст на фото, понимают видео; версия 4.6 весит всего 1.3B.
- Распознавание текста на фото прямо на устройстве
- Разбор чеков и документов без отправки в облако
- Описание фото и видео
- Размеры
- 1.3B – 8B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024–2026
IBM · США
Лёгкие эмбеддинги IBM для корпоративного поиска, обученные на данных с понятными правами. R2 2026 года стали многоязычными.
- Поиск по корпоративным документам
- RAG на обычном сервере без видеокарты
- Переранжирование результатов
- Размеры
- 30M – 311M
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2024–2026
IBM · США
Модели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.
- Проверка запросов и ответов бота
- Поиск выдуманных фактов в ответах по базе знаний
- Проверка своих правил, заданных текстом
- Размеры
- 38M – 8B
- Железо
- от: Ноутбук
Картинка + текстOllama2025–2026
IBM · США
Компактные модели IBM для корпоративных документов: таблицы, графики, формы, пары «поле — значение». Карточка честно предупреждает, что лучше всего работает с английским.
- Извлечение полей из форм и счетов
- Перевод графиков и таблиц в данные
- Ответы на вопросы по документам
- Размеры
- 2B – 4B
- Железо
- от: Ноутбук
Разбор текстаOllama2024–2026
NuMind · Франция
Модели для извлечения данных по шаблону: даёте документ или скан и JSON-шаблон полей, получаете заполненный JSON. NuExtract3 (4B) заодно переводит сканы в Markdown.
- Извлечение реквизитов, сумм и дат из счетов и договоров в JSON
- Разбор чеков, накладных и анкет по заданному шаблону
- Перевод сканов в Markdown для поиска
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
КодOllama2025–2026
Essential AI · США
Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.
- Генерация и исправление кода
- Агент-разработчик на одной видеокарте
- Решение технических и научных задач
- Размеры
- 8B
- Железо
- от: Ноутбук
КодOllama2024–2026
Alibaba (команда Qwen) · Китай
Самая широкая открытая линейка для кода: от 0.5B для автодополнения до 480B для агентов. Qwen3-Coder-Next (80B, активны 3B) работает как агент-разработчик на одной видеокарте.
- Автодополнение кода в редакторе
- Агент, который сам правит код в репозитории
- Генерация и доработка скриптов, SQL, интеграций
- Размеры
- 0.5B – 480B-A35B
- Железо
- от: Ноутбук
МедицинаOllama2025–2026
Google · США
Медицинская версия Gemma от Google: читает медицинские тексты и снимки (рентген, дерматология, гистология). Инструмент для врача и разработчика, не заменяет врача, решения принимает специалист.
- Черновики выписок и заключений для проверки врачом
- Подсказки при разборе снимков для врача
- Поиск и пересказ медицинской литературы
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2025–2026
Alibaba (Qwen) · Китай
Эмбеддинги и реранкеры на базе Qwen3, в числе лучших открытых для многоязычного поиска, включая русский. VL-версии ищут по картинкам, скриншотам и видео.
- Поиск по базе знаний для RAG
- Переранжирование найденного перед ответом
- Поиск по сканам, слайдам и скриншотам
- Размеры
- 0.6B – 8B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Technology Innovation Institute (TII) · ОАЭ
Семейство из Абу-Даби: от ранних Falcon 40B и 180B до гибридных Falcon-H1 и сверхмалых Falcon-H1-Tiny на 90–600M параметров для устройств.
- Ассистент и ответы по документам
- Работа на слабом железе и в устройствах
- Вызов инструментов в простых агентах
- Размеры
- 90M – 180B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Microsoft · США
Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.
- Ассистент на ноутбуке или своём сервере
- Задачи с рассуждением и расчётами
- Разбор изображений и схем (vision-версии)
- Размеры
- 1.3B – 42B-A6.6B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
Allen Institute for AI (Ai2) · США
Полностью открытые модели: опубликованы не только веса, но и данные, код обучения и промежуточные снимки. Удобно, когда важна прозрачность происхождения.
- Ассистент и ответы по документам
- Задачи с рассуждением (версии Think)
- Дообучение под свои данные с понятной историей модели
- Размеры
- 1B – 32B
- Железо
- от: Ноутбук
ПереводRUOllama2026
Google · США
Переводчики на базе Gemma 3 на 55 языков, умеют переводить и текст на картинках. Русский есть. Версия 4B помещается на ноутбук.
- Перевод документов и переписки
- Перевод текста со скриншотов и фото
- Локализация сайтов и приложений
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
Документы и OCROllama2025–2026
DeepSeek · Китай
OCR-модель, которая сильно сжимает страницу в небольшое число визуальных токенов, поэтому быстро обрабатывает большие объёмы. Версия 2 лучше понимает порядок чтения.
- Массовое распознавание сканов счетов и договоров
- Распознавание таблиц
- Перевод PDF в Markdown для поиска и RAG
- Размеры
- около 3B
- Железо
- от: Ноутбук
Документы и OCRRUOllama2026
Zhipu AI (Z.ai) · Китай
Лёгкая OCR-модель Zhipu для разбора документов. В карточке русский указан среди поддерживаемых языков; рассчитана на высокую нагрузку и слабое железо.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Распознавание таблиц и формул
- Извлечение полей в JSON
- Размеры
- 0.9B
- Железо
- от: Ноутбук
КодRUOllama2025
Mistral AI (с All Hands AI) · Франция
Модели Mistral для агентной разработки: сами читают репозиторий, правят файлы и запускают команды. Версия 24B помещается на одну видеокарту.
- Агент-разработчик для исправления задач из трекера
- Доработка внутренних систем по описанию
- Автоматизация рутинных правок в коде
- Размеры
- 24B – 123B
- Железо
- от: 1 видеокарта
ТекстOllama2023–2025
Nous Research · США
Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.
- Агенты, вызывающие функции и API
- Извлечение данных в строгом формате JSON
- Ассистент с гибкой настройкой роли и тона
- Размеры
- 3B – 405B
- Железо
- от: Ноутбук
ТекстOllama2025
Deep Cogito · США
Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.
- Чат-ассистент с режимом рассуждений
- Написание кода и вызов инструментов
- Ответы на сложные вопросы по документам
- Размеры
- 3B – 671B
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2025
OpenAI · США
Модерация по вашим правилам: политику пишете обычным текстом, модель рассуждает и выносит решение с объяснением. Построена на gpt-oss.
- Модерация по внутренним правилам компании
- Разметка спорных сообщений с объяснением
- Проверка отзывов и объявлений перед публикацией
- Размеры
- 20B – 120B
- Железо
- от: 1 видеокарта
Картинка + текстOllama2023–2025
Alibaba (команда Qwen) · Китай
Одна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.
- Извлечение данных из сканов счетов и накладных
- Разбор фотографий товаров и витрин
- Анализ видео и записей с камер
- Размеры
- 2B – 235B-A22B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024–2025
Mixedbread · Германия
Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.
- Поиск по базе знаний
- Переранжирование результатов перед ответом бота
- Поиск по каталогу товаров
- Размеры
- 17M – 1.5B
- Железо
- от: Ноутбук
Поиск и RAGOllama2025
Google · США
Маленькая многоязычная модель эмбеддингов на базе Gemma 3, работает даже на телефоне и ноутбуке без интернета.
- Поиск по документам на устройстве
- RAG без отправки данных наружу
- Классификация текстов
- Размеры
- 300M
- Железо
- от: Ноутбук
Поиск и RAGOllama2023–2025
BAAI (Пекинская академия ИИ) · Китай
Одни из самых популярных эмбеддингов для поиска и RAG. Основные версии v1.5 рассчитаны на английский и китайский; для русского у BAAI есть отдельная bge-m3.
- Поиск по документам на английском
- Подбор фрагментов для ответа чат-бота (RAG)
- Поиск по коду (bge-code)
- Размеры
- 24M – 9B
- Железо
- от: Ноутбук
ТекстOllama2025
OpenAI · США
Первые открытые модели OpenAI со времён GPT-2. Рассуждения, вызов инструментов, младшая версия помещается на одну видеокарту.
- ИИ-агент с вызовом внутренних систем
- Ответы по регламентам
- Черновики писем и отчётов
- Размеры
- 20B, 120B
- Железо
- от: 1 видеокарта
ТекстRUOllama2024–2025
Hugging Face · США
Крошечные открытые модели Hugging Face для телефонов и ноутбуков. SmolLM3 на 3B умеет рассуждать и держит длинный контекст, весь рецепт обучения открыт.
- Простой ассистент прямо на устройстве
- Классификация и маршрутизация обращений
- Основа для дообучения под узкую задачу
- Размеры
- 135M – 3B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025
Agentica (Беркли, Sky Computing Lab) и Together AI · США
Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.
- Решение математических задач с пошаговым выводом
- Генерация и проверка кода
- Агент для исправления ошибок в репозитории
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
ТекстOllama2025
DeepSeek · Китай
Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.
- Сложные расчёты и проверка логики
- Анализ договоров и регламентов
- Помощь программистам
- Размеры
- 1,5B – 671B
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Meta · США
Модели, с которых начался массовый open source в ИИ. Огромная экосистема дообученных версий и инструментов.
- Ассистент для сотрудников
- Суммаризация встреч и документов
- Основа для дообучения под отрасль
- Размеры
- 1B – 405B
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2023–2025
Meta · США
Модели-фильтры, которые проверяют запросы к чат-боту и его ответы на опасные темы по списку категорий. Версия 4 проверяет и картинки. Русский официально не заявлен.
- Проверка вопросов пользователей к боту
- Проверка ответов бота перед отправкой
- Отчёт, какая категория правил нарушена
- Размеры
- 1B – 12B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики договоров и регламентов
- Размеры
- 32B
- Железо
- от: 1 видеокарта
Поиск и RAGRUOllama2024–2025
Nomic AI · США
Полностью открытые эмбеддинги — с весами, данными и кодом обучения. v2 многоязычная на MoE, есть версии для кода и для поиска по PDF-страницам.
- Поиск по документам и базе знаний
- Поиск по коду
- Поиск по сканам и PDF без распознавания
- Размеры
- 137M – 7B
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2024–2025
Google · США
Фильтры на базе Gemma: проверяют текст на опасный и оскорбительный контент, а ShieldGemma 2 проверяет картинки. Ориентированы на английский.
- Модерация сообщений пользователей
- Проверка ответов бота
- Проверка сгенерированных картинок перед публикацией
- Размеры
- 2B – 27B
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Ai2 · США
Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.
- Ассистент для сотрудников на своём сервере
- Математика и точное следование инструкциям
- Образец рецепта для собственного дообучения
- Размеры
- 7B – 405B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.
- Расчёты и проверка формул
- Проверка расчётов в сметах и отчётах
- Разбор задач по шагам
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2019–2025
UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия
Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.
- Поиск по базе знаний и FAQ
- Поиск похожих обращений и дублей
- Группировка отзывов и заявок по темам
- Размеры
- около 20M – 470M
- Железо
- от: Ноутбук
Разбор текстаRUOllama2024–2025
Jina AI · Германия
Маленькие модели, которые превращают сырой HTML веб-страниц в чистый Markdown или JSON. Удобно готовить сайты для базы знаний. Лицензия только некоммерческая.
- Очистка страниц сайтов для базы знаний
- Извлечение данных со страниц в JSON
- Подготовка текстов для RAG
- Размеры
- 0.5B – 1.5B
- Железо
- от: Ноутбук
Поиск и RAGRUOllama2024
Snowflake · США
Эмбеддинги от Snowflake, заточенные именно под поиск. Версия 2.0 многоязычная (русский в списке языков), держит длинные тексты до 8 тыс. токенов и умеет сжимать векторы.
- Поиск по документам и базе знаний
- Подбор фрагментов для RAG
- Поиск по отчётам и внутренним данным
- Размеры
- 22M – 568M
- Железо
- от: Ноутбук
КодOllama2024
INF Technology · Китай
Полностью воспроизводимые модели для кода: вместе с весами открыты данные, конвейер их очистки и рецепт обучения. Понимают английский и китайский.
- Генерация и дополнение кода
- Обучение своей модели для кода по открытому рецепту
- Ассистент программиста на слабом железе
- Размеры
- 1.5B – 8B
- Железо
- от: Ноутбук
ТекстOllama2024
Nexusflow · США
Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.
- Исследование агентов и вызова функций
- Сравнение с коммерческими моделями
- Эксперименты с чат-ассистентом
- Размеры
- 70B – 72B
- Железо
- от: 1 видеокарта
КодOllama2023–2024
DeepSeek · Китай
Линейка моделей для кода от DeepSeek: от маленьких для автодополнения до большой MoE V2, которая в 2024 году была на уровне закрытых моделей. Позже код ушёл в общие модели DeepSeek.
- Автодополнение и генерация кода
- Перевод кода между языками
- Поиск ошибок и объяснение чужого кода
- Размеры
- 1.3B – 236B-A21B
- Железо
- от: Ноутбук
КодOllama2024
01.AI · Китай
Модели для кода от 01.AI на 1.5B и 9B с контекстом 128 тыс. токенов и поддержкой 52 языков программирования. Отдельная линейка рядом с текстовыми Yi.
- Автодополнение и генерация кода
- Объяснение и рефакторинг кода
- Ассистент программиста без облака
- Размеры
- 1.5B – 9B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовOllamaНе развивается2024
UT Austin и Bespoke Labs · США
Проверяет, подтверждается ли каждое утверждение в ответе ИИ исходными документами. Малые версии свободные, старшая 7B есть в Ollama, но некоммерческая.
- Проверка ответов RAG-бота по документам
- Поиск неподтверждённых утверждений в отчётах и пересказах
- Автоматический контроль качества ИИ-ответов
- Размеры
- 0.4B – 7B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
Stability AI · Великобритания
Малые модели Stability AI: StableLM 2 на 1.6B знает 7 европейских языков, Stable Code на 3B дописывает код. Обновлений с 2024 года нет.
- Лёгкий чат-бот на обычном ПК
- Автодополнение кода в редакторе
- Основа для дообучения под свою задачу
- Размеры
- 1.6B – 12B
- Железо
- от: Ноутбук
КодOllamaНе развивается2024
Mistral AI · Франция
Модель Mistral для кода на 80+ языках программирования. Открытые веса основной версии нельзя использовать в работе без платной лицензии; новые версии Codestral только по API.
- Оценка и тесты перед покупкой лицензии
- Автодополнение кода (при коммерческой лицензии)
- Исследование качества моделей для кода
- Размеры
- 7B – 22B
- Железо
- от: Ноутбук
КодOllamaНе развивается2023–2024
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Модели для кода от создателей GLM. CodeGeeX4-ALL-9B на базе GLM-4-9B в одной модели совмещает автодополнение, чат по коду, вызов функций и поиск по репозиторию.
- Автодополнение кода в IDE
- Чат-помощник по коду
- Ответы на вопросы по репозиторию
- Размеры
- 6B – 9B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
OpenChat (Университет Цинхуа) · Китай
Дообучения Mistral 7B и Llama 3 8B по методу C-RLFT, которые в 2023–2024 годах догоняли ChatGPT-3.5 при размере 7–8B. Лёгкий универсальный ассистент для слабого сервера.
- Чат-ассистент на недорогом сервере
- Черновики писем и ответов
- Помощь с простым кодом
- Размеры
- 7B – 13B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
01.AI · Китай
Двуязычные (английский и китайский) модели 01.AI на 6–34B с версиями на контекст до 200 тыс. токенов. Новых открытых выпусков с 2024 года нет.
- Чат-ассистент на одной видеокарте
- Разбор длинных документов
- Классификация и извлечение данных из текста
- Размеры
- 6B – 34B
- Железо
- от: Ноутбук
Текст в SQLOllamaНе развивается2023–2024
Defog · США
Одна из первых открытых моделей, которые переводят вопрос на обычном языке в SQL-запрос к базе. Есть в Ollama, но свежие конкуренты уже сильнее.
- Ответы на вопросы менеджеров по базе продаж без аналитика
- Черновики SQL-запросов для отчётов
- Помощник внутри BI-системы
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
КодOllamaНе развивается2023–2024
BigCode (Hugging Face и ServiceNow) · США / Франция
Одна из первых открытых моделей для кода, обучена на открытом наборе исходников с возможностью исключить свой репозиторий. Сегодня скорее база для дообучения, чем лидер.
- Автодополнение кода в редакторе
- Дообучение на внутреннем коде компании
- Генерация шаблонного кода и тестов
- Размеры
- 1B – 15B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
Hugging Face (H4) · США
Учебные чат-модели Hugging Face на базе Mistral, Gemma и Mixtral с открытым рецептом дообучения. Zephyr 7B Beta показал, что маленькую модель можно «воспитать» до уровня крупных без ручной разметки людьми.
- Лёгкий чат-ассистент
- Образец и отправная точка для своего дообучения
- Черновики текстов и ответов
- Размеры
- 7B – 141B-A35B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
TinyLlama (исследователи SUTD) · Сингапур
Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.
- Простые чат-боты на слабом железе
- Эксперименты и обучение команды
- Основа для дообучения под узкую задачу
- Размеры
- 1.1B
- Железо
- от: Ноутбук
Поиск и RAGRUOllamaНе развивается2024
BAAI · Китай
Модель для поиска по смыслу на сотне языков. Основа RAG: бот находит нужный кусок документа перед ответом.
- Поиск по базе документов
- RAG для чат-бота
- Поиск похожих обращений и дублей
- Размеры
- 568M
- Железо
- от: Ноутбук
КодOllamaНе развивается2023–2024
Meta · США
Версия Llama 2, доученная на коде; есть варианты для Python и для диалога. Устарела, но много готовых дообученных версий и инструментов.
- Автодополнение и объяснение кода
- Генерация скриптов на Python
- Базовая модель для дообучения под свой стек
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
WizardLM (Microsoft и Пекинский университет) · США / Китай
Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.
- Сложные многошаговые инструкции
- Помощь программистам
- Решение математических задач
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
Текст в SQLOllamaНе развивается2024
MotherDuck и Numbers Station · США
Модель для перевода вопросов в SQL, заточенная под встраиваемую аналитическую базу DuckDB. Есть в Ollama, удобна для локальной работы с CSV и Parquet.
- Вопросы к выгрузкам CSV и Parquet на обычном языке
- Запросы к DuckDB внутри аналитических скриптов
- Быстрая аналитика на ноутбуке без сервера
- Размеры
- 7B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
Intel · США
Дообученная Mistral 7B от Intel, показывавшая обучение и запуск на процессорах и ускорителях Intel. Устарела, интересна как пример оптимизации под железо Intel.
- Простой чат-ассистент
- Эксперименты с запуском на железе Intel
- Основа для дообучения
- Размеры
- 7B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
Microsoft Research · США
Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.
- Исследования методов рассуждения
- Сравнение с современными малыми моделями
- Обучение специалистов
- Размеры
- 7B – 13B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
LMSYS (Беркли и партнёры) · США
Одна из первых открытых чат-моделей 2023 года: LLaMA, дообученная на диалогах пользователей ChatGPT. Историческая веха, сегодня уступает любой современной модели того же размера.
- Эксперименты и обучение команды
- Простой чат-ассистент для тестов
- Сравнение с новыми моделями
- Размеры
- 7B – 33B
- Железо
- от: Ноутбук