МедицинаGGUF2023–2026
FreedomIntelligence (Китайский университет Гонконга, Шэньчжэнь) · Китай
Большое семейство медицинских моделей: чат, версия со снимками, рассуждающая HuatuoGPT-o1 и новая HuatuoGPT-3 на Qwen3. Не заменяет врача, решения принимает специалист.
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Подсказки при разборе снимков для врача (Vision)
- Размеры
- 7B – 72B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
DeepSeek · Китай
Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.
- Ассистент для сотрудников на своём сервере
- Разбор длинных договоров и отчётов
- Агенты, которые работают с инструментами и API
- Размеры
- 7B – 1.6T-A49B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Shanghai AI Laboratory · Китай
Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.
- Помощник исследователя: статьи, формулы, данные
- Разбор научных и технических документов
- Корпоративный чат на малых моделях
- Размеры
- 1.8B – около 1T
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Xiaomi · Китай
Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.
- Логические и расчётные задачи
- Агенты с инструментами
- Помощь программистам
- Размеры
- 7B – 1,02T-A42B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Сбер · Россия
Открытые модели Сбера, обученные с упором на русский язык: хорошо пишут и понимают по-русски, знают местные реалии. Есть лёгкая 10B-A1.8B и флагманы до 702B, всё под MIT. GigaChat3.1-Audio понимает звук и записи до двух часов, GFusion — быстрая диффузионная версия для текста.
- Русскоязычный ассистент для сотрудников на своём сервере
- Ответы клиентам и разбор обращений на русском
- Работа с договорами и внутренними регламентами
- Размеры
- 10B-A1.8B – 702B-A36B
- Железо
- от: Ноутбук
ТекстRU2022–2026
Яндекс · Россия
Модели Яндекса, обученные с нуля с упором на русский язык и российские реалии. Новая AliceAI-Foundation 80B-A3B (Apache 2.0) — только базовая модель, инструкт-версии нет: её дообучают под свои задачи. Рядом экономичная AliceAI-T5 35B-A0.6B.
- Русскоязычный ассистент и чат-бот
- Ответы на вопросы по базе знаний компании
- Основа для дообучения под свою отрасль
- Размеры
- 8B – 100B
- Железо
- от: Ноутбук
ТекстRUOllama2024–2026
Cohere Labs · Канада
Многоязычные модели исследовательского крыла Cohere, от 23 до 100+ языков. Tiny Aya 2026 года на 3.3B работает на обычном ПК, но только некоммерчески.
- Перевод и переписка на редких языках
- Многоязычный чат-ассистент
- Разбор изображений с текстом (Vision)
- Размеры
- 3.3B – 35B
- Железо
- от: Ноутбук
Текст2024–2026
OpenBMB (ModelBest и Университет Цинхуа) · Китай
Компактные текстовые модели для работы прямо на устройстве: ноутбуке, телефоне, мини-ПК. MiniCPM5 на 1B и 2B ориентированы на вызов инструментов и длинный контекст.
- Локальный чат-ассистент без облака
- Извлечение данных и классификация текстов
- Вызов инструментов и простые агенты на слабом железе
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
Текст2024–2026
MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ
Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.
- Рассуждения, математика и технические вопросы
- Разбор длинных документов
- Агенты и написание кода
- Размеры
- 0.9B – 375B-A23B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Жэньминьский университет (GSAI) и Ant Group (inclusionAI) · Китай
Диффузионные языковые модели: текст пишется не по одному слову, а сразу блоками с последующим уточнением, что ускоряет генерацию. LLaDA2.2 умеет править уже написанное и рассчитана на агентов. Генератор картинок LLaDA-Image — отдельный продукт.
- Быстрая генерация кода и текстов
- Агентные сценарии с длинным контекстом
- Исследования альтернатив обычным LLM
- Размеры
- 8B – 100B (MoE)
- Железо
- от: 1 видеокарта
ТекстRU2026
SberDevices (ai-forever) · Россия
Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.
- Эксперименты с ускорением генерации
- Дообучение небольших моделей под свои задачи
- Исследования
- Размеры
- 0.6B – 4B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Alibaba · Китай
Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.
- Чат-бот и ассистент по базе знаний
- Ответы на письма и обращения
- Разбор и классификация документов
- Размеры
- 0,6B – 2,4T-A95B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Zhipu AI (Z.ai) · Китай
Одна из старейших китайских открытых линий: от ChatGLM-6B до GLM-5.3. Сильна в агентных задачах и программировании; GLM-5.3-Flash понимает картинки и выходит под MIT.
- Корпоративный чат-ассистент
- Агенты для рутинных офисных задач
- Помощь программистам
- Размеры
- 1.5B – 744B-A40B
- Железо
- от: Ноутбук
Текст2024–2026
Tencent · Китай
Языковые модели Tencent: от малых 0.5B–7B до Hy4-preview на 770 млрд параметров. С 2026 года линия переименована в Hy, а новые версии вышли под Apache 2.0.
- Корпоративный ассистент
- Перевод и работа с многоязычными текстами
- Агенты с инструментами
- Размеры
- 0.5B – 770B-A49B
- Железо
- от: Ноутбук
Текст2025–2026
Ant Group (inclusionAI) · Китай
Семейство Ant Group: Ling — обычные модели, Ring — рассуждающие. Есть и триллионные флагманы, и экономичная Ling-3.0-tiny, которой хватает 1,3 млрд активных параметров.
- Корпоративный ассистент
- Агенты для офисных процессов
- Финансовая аналитика (есть версия Fin)
- Размеры
- 7.9B-A1.3B – 1T
- Железо
- от: Ноутбук
ТекстRUOllama2024–2026
Cohere · Канада
Модели для бизнеса: поиск по документам со ссылками на источники, вызов инструментов, много языков. Command A+ 2026 года впервые вышла под Apache 2.0, за ней — линейка North: код, перевод и компактное зрение.
- Ответы по базе знаний со ссылками на источники
- Агенты, работающие с внутренними системами
- Перевод и переписка на разных языках
- Размеры
- 2.5B – 218B-A25B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
NVIDIA · США
Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).
- Агенты с вызовом инструментов
- Задачи с рассуждением и расчётами
- Ответы по длинным документам
- Размеры
- 4B – 550B-A55B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
IBM · США
Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.
- Ответы по внутренним документам (RAG)
- Вызов инструментов и работа в агентах
- Извлечение данных и классификация
- Размеры
- 350M – 34B
- Железо
- от: Ноутбук
ТекстRUOllama2025–2026
Liquid AI · США
Модели новой архитектуры для работы прямо на устройстве: быстрые на обычном процессоре и в телефоне. Есть версии для извлечения данных, RAG и инструментов, а также LFM2.5-VL для картинок и голосовая LFM2.5-Audio.
- Ассистент на ноутбуке или телефоне без интернета
- Извлечение данных из документов
- Вызов инструментов в приложениях
- Размеры
- 230M – 24B-A2B
- Железо
- от: Ноутбук
ТекстOllama2026
Meta Superintelligence Labs · США
Открытая модель Meta для агентов на доступном железе: дистиллирована из закрытой Muse Spark, понимает текст и картинки, обучена на 100+ языках.
- Агенты с вызовом инструментов
- Разбор скриншотов, графиков и документов
- Многоязычный ассистент
- Размеры
- 30B
- Железо
- от: 1 видеокарта
ТекстRUOllama2023–2026
Mistral AI · Франция
Европейские модели с упором на скорость. Mixtral — одна из первых открытых моделей на архитектуре «смесь экспертов»; есть версии с картинками (Pixtral, Medium 3.5), для доказательств в Lean и модерации (Shieldstral).
- Быстрые ответы в чате
- Извлечение данных из текста
- Перевод и работа с несколькими языками
- Размеры
- 3B – 675B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Moonshot AI · Китай
Сверхкрупные MoE-модели Moonshot для агентной работы. K3 на 2,8 трлн параметров — самая большая открытая модель на момент выхода, с контекстом до 1 млн токенов и пониманием картинок; K2.7-Code заточена под программирование.
- Многошаговые агенты: поиск, сбор данных, отчёты
- Глубокий анализ документов
- Помощь программистам
- Размеры
- 16B-A3B – 2.8T-A104B
- Железо
- от: 1 видеокарта
ТекстGGUF2025–2026
Meituan · Китай
Модели Meituan (крупнейший сервис доставки Китая). LongCat-Flash динамически меняет объём вычислений под сложность запроса; LongCat-2.0 — 1,6 трлн параметров под MIT. Есть омни-модели (Flash-Omni, Next) и синтез речи AudioDiT.
- Агенты для заказов и сервисных процессов
- Корпоративный ассистент
- Разбор длинных документов
- Размеры
- 1B – 1.6T-A48B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
LG AI Research · Южная Корея
Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.
- Корпоративный ассистент
- Работа с корейскими и английскими текстами
- Разбор документов и картинок (4.5)
- Размеры
- 1.2B – 750B-A37B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Upstage · Южная Корея
Модели корейской Upstage. Solar Open 2 рассчитана на офисную работу с документами: 250 млрд параметров, из них активны 15 млрд, языки — английский, корейский, японский.
- Работа с офисными документами
- Агенты для рутинных задач
- Помощь программистам
- Размеры
- 10.7B – 250B-A15B
- Железо
- от: 1 видеокарта
ТекстGGUF2025–2026
Kakao · Южная Корея
Компактные корейско-английские модели Kakao. Kanana 2 30B-A3B работает быстро за счёт MoE, малые версии на 1–3B подходят для обычного ПК.
- Чат-бот поддержки
- Классификация обращений
- Лёгкий ассистент на своём ПК
- Размеры
- 1.3B – 30B-A3B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Т-Банк · Россия
Модели Т-Банка, дообученные на основе Qwen специально для русского языка: заметно лучше исходной модели пишут и рассуждают по-русски. T-Lite — 8B, T-Pro — 32B на одну видеокарту; T-Search — агент для многошагового поиска на русском и английском.
- Русскоязычный чат-бот поддержки
- Разбор обращений и документов на русском
- Ответы по базе знаний компании
- Размеры
- 7B – 36B-A3B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Swiss AI (ETH Zurich, EPFL, CSCS) · Швейцария
Государственная открытая модель Швейцарии: открыты веса, данные и рецепт, более 1000 языков в обучении. Версия 1.5 понимает изображения.
- Многоязычный ассистент
- Ответы по документам
- Разбор изображений и сканов (v1.5)
- Размеры
- 0.5B – 70B
- Железо
- от: Ноутбук
ТекстGGUF2026
Thinking Machines Lab · США
Флагманские открытые модели лаборатории Миры Мурати: принимают текст, изображения и аудио. Большие MoE, требуют нескольких видеокарт.
- Корпоративный ассистент уровня флагмана
- Разбор документов, изображений и аудио
- Помощь в программировании
- Размеры
- 276B-A12B, 975B-A41B
- Железо
- от: Кластер
КодGGUF2026
Poolside · США
Модели для агентного программирования: самостоятельно правят код в репозитории. Младшая XS запускается на Mac с 36 ГБ памяти, у S 2.1 контекст 1M токенов.
- Агент-программист для внутренней разработки
- Исправление ошибок и доработка кода
- Работа с большими кодовыми базами
- Размеры
- 33B-A3B – 225B-A23B
- Железо
- от: 1 видеокарта
ТекстOllama2024–2026
Google · США
Компактные модели Google: хорошо работают на одном компьютере, старшие версии понимают картинки. Есть CodeGemma для кода, FunctionGemma 270M для вызова функций и быстрая DiffusionGemma.
- Ассистент на ноутбуке без интернета
- Разбор фото документов и чеков
- Классификация обращений
- Размеры
- 270M – 31B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025–2026
Open Thoughts (Стэнфорд, Беркли и другие университеты) · США
Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики регламентов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
ТекстRUGGUF2025–2026
MiniMax · Китай
Крупные MoE-модели с очень длинным контекстом (до 1 млн токенов у Text-01 и M3). M3 — мультимодальная, понимает картинки. Лицензии сильно различаются от версии к версии.
- Анализ больших архивов документов за один запрос
- Агенты с инструментами
- Помощь программистам
- Размеры
- 230B-A10B – 456B-A46B
- Железо
- от: Кластер
МедицинаOllama2023–2026
EPFL · Швейцария
Открытые медицинские модели швейцарского EPFL, которые дообучают поверх разных базовых моделей по клиническим руководствам. Не заменяет врача, решения принимает специалист.
- Ответы персоналу по клиническим руководствам
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 2B – 70B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Cognitive Computations (Эрик Хартфорд) · США
Дообучения без встроенной цензуры поверх Llama, Mistral, Qwen и других: модель выполняет почти любые запросы. Ответственность за фильтрацию и модерацию полностью на том, кто её внедряет, — без своего фильтра клиентам её не показывать.
- Ассистент, который не отказывает в законных, но «острых» темах
- Внутренние инструменты под жёстким системным промптом
- Ролевые и творческие сценарии
- Размеры
- 0.5B – 405B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
StepFun · Китай
MoE-модели StepFun, рассчитанные на быструю и дешёвую работу: при 196 млрд параметров Step-3.5/3.7-Flash задействуют около 11 млрд на токен. Есть компактные Step3-VL-10B для картинок и голосовая Step-Audio 2 mini.
- Агенты с высокой нагрузкой
- Разбор документов со схемами и скриншотами
- Помощь программистам
- Размеры
- 8B – 321B
- Железо
- от: 1 видеокарта
ТекстGGUF2025–2026
Baidu · Китай
Первая открытая линия Baidu: от крошечной 0.3B до MoE на 424 млрд параметров, есть версии с пониманием картинок. Средняя 21B-A3B помещается на одну видеокарту; ERNIE-Image 8B рисует картинки с текстом.
- Корпоративный ассистент
- Разбор документов и изображений
- Классификация обращений
- Размеры
- 0.3B – 424B-A47B
- Железо
- от: Ноутбук
ТекстRUGGUF2025–2026
Arcee AI · США
Американское семейство MoE-моделей, обученных с нуля: Nano, Mini и Large. Trinity-Large-Thinking на 398B рассуждает перед ответом.
- Агенты с вызовом инструментов
- Задачи с рассуждением
- Корпоративный ассистент на своих серверах
- Размеры
- 6B – 398B-A13B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
ServiceNow · США
Модели ServiceNow на 15B с пошаговыми рассуждениями, которые помещаются на одну видеокарту. С версии 1.5 понимают и картинки, хорошо вызывают инструменты.
- Ассистент с рассуждениями для внутренних сервисов
- Вызов инструментов и корпоративные агенты
- Разбор скриншотов и документов с картинками
- Размеры
- 5B – 15B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовRU2025–2026
SberDevices (ai-forever) · Россия
Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.
- Автоматическая проверка качества ответов чат-бота на русском
- Сравнение нескольких моделей перед выбором
- Контроль ответов после дообучения
- Размеры
- 4B – 32B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Иван Бондаренко (bond005), НГУ · Россия
Русскоязычные модели для работы с документами, а не для болтовни: ответы по базе знаний, извлечение сущностей и фактов из текста на русском, длинный контекст.
- Ответы на вопросы по внутренним документам
- Извлечение имён, дат и сумм из договоров
- Краткое изложение длинных текстов на русском
- Размеры
- 1.5B – 7.6B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
Sarvam AI · Индия
Индийские модели с упором на 22 языка Индии. Sarvam 30B и 105B 2026 года это MoE-модели с сильными навыками рассуждения и работы в агентах.
- Многоязычная поддержка клиентов
- Задачи с рассуждением и расчётами
- Агенты с вызовом инструментов
- Размеры
- 2B – 105B-A10B
- Железо
- от: Ноутбук
Текст2025–2026
Reka AI · США
Компактные модели Reka: Flash 3 на 21B для рассуждений и Reka Edge на 7B, которая быстро разбирает изображения и видео на устройстве.
- Разбор фото и видео (Edge)
- Поиск объектов на изображениях
- Задачи с рассуждением (Flash)
- Размеры
- 7B – 21B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2026
LM Provers (CMU, Hugging Face, ETH Zurich, Project Numina) · США, Швейцария, Франция
Маленькая модель 4B на Qwen3, которая пишет математические доказательства на обычном языке почти на уровне больших моделей. Запускается на ноутбуке.
- Проверка логики рассуждений и выкладок
- Пошаговое объяснение решений
- Обучение и олимпиадная подготовка
- Размеры
- 4B
- Железо
- от: Ноутбук
МедицинаOllama2025–2026
Google · США
Медицинская версия Gemma от Google: читает медицинские тексты и снимки (рентген, дерматология, гистология). Инструмент для врача и разработчика, не заменяет врача, решения принимает специалист.
- Черновики выписок и заключений для проверки врачом
- Подсказки при разборе снимков для врача
- Поиск и пересказ медицинской литературы
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
МедицинаGGUF2025–2026
Ant Healthcare (Ant Group) и Центр медицинской информации провинции Чжэцзян · Китай
Крупная медицинская MoE-модель на базе Ling-flash-2.0: 100B параметров, из них в работе 6B, поэтому отвечает быстро. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу по клиническим вопросам
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 100B-A6B
- Железо
- от: 1 видеокарта
ТекстGGUF2023–2026
Baichuan Intelligence · Китай
Сначала универсальные китайские модели, с 2025 года — медицинская линия. Baichuan-M3 (на основе Qwen3-235B) обучена моделировать ход клинического рассуждения врача.
- Справочный помощник врача
- Предварительный опрос пациента
- Разбор медицинских документов
- Размеры
- 7B – 235B-A22B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Technology Innovation Institute (TII) · ОАЭ
Семейство из Абу-Даби: от ранних Falcon 40B и 180B до гибридных Falcon-H1 и сверхмалых Falcon-H1-Tiny на 90–600M параметров для устройств.
- Ассистент и ответы по документам
- Работа на слабом железе и в устройствах
- Вызов инструментов в простых агентах
- Размеры
- 90M – 180B
- Железо
- от: Ноутбук
ТекстRUOllama2023–2026
Microsoft · США
Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.
- Ассистент на ноутбуке или своём сервере
- Задачи с рассуждением и расчётами
- Разбор изображений и схем (vision-версии)
- Размеры
- 1.3B – 42B-A6.6B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
Allen Institute for AI (Ai2) · США
Полностью открытые модели: опубликованы не только веса, но и данные, код обучения и промежуточные снимки. Удобно, когда важна прозрачность происхождения.
- Ассистент и ответы по документам
- Задачи с рассуждением (версии Think)
- Дообучение под свои данные с понятной историей модели
- Размеры
- 1B – 32B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
AI21 Labs · Израиль
Гибрид трансформера и Mamba с окном до 256K токенов: держит длинные документы быстрее обычных моделей. Jamba2 ориентирована на точные ответы по источникам.
- Ответы по длинным регламентам и договорам
- Поиск по базе знаний (RAG)
- Пересказ больших документов
- Размеры
- 3B – 398B-A94B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
Prime Intellect · США
Модели, обученные распределённо на видеокартах со всего мира. INTELLECT-3 на 106B дообучена с подкреплением для математики, кода и агентов.
- Задачи с рассуждением и математикой
- Помощь в программировании
- Агенты с вызовом инструментов
- Размеры
- 10B – 106B-A12B
- Железо
- от: 1 видеокарта
ТекстRUGGUF2024–2026
Консорциум UTTER (Unbabel, университеты Лиссабона, Эдинбурга, Амстердама и др.) · Евросоюз
Европейские языковые модели, обученные на всех языках ЕС и ряде других, с упором на перевод. Русский есть. Свободная лицензия.
- Перевод и локализация текстов
- Ответы на вопросы на разных языках
- Черновики писем для зарубежных партнёров
- Размеры
- 1.7B – 22B
- Железо
- от: Ноутбук
Кибербезопасность2025–2026
Cisco (Foundation AI) · США
Модели Cisco для информационной безопасности на базе Llama 3.1 8B: разбор уязвимостей, угроз и инцидентов. Можно развернуть внутри периметра.
- Разбор отчётов об уязвимостях и угрозах
- Помощь аналитику SOC при инцидентах
- Сопоставление угроз с MITRE ATT&CK
- Размеры
- 8B
- Железо
- от: Ноутбук
Текст2025
Naver · Южная Корея
Открытые младшие модели корейского Naver: от 0.5B до 32B, включая рассуждающие Think и мультимодальные версии с пониманием картинок.
- Лёгкий корейско-английский ассистент
- Разбор картинок и документов
- Классификация текстов
- Размеры
- 0.5B – 32B
- Железо
- от: Ноутбук
ТекстRUGGUF2024–2025
Vikhr Models · Россия
Русскоязычные дообучения открытых моделей (Mistral, Qwen, Llama) от независимой команды Vikhr: улучшают русский язык, есть компактные версии для обычного ПК. Borealis — аудио-модель для распознавания и понимания русской речи.
- Русскоязычный ассистент на своём ПК или сервере
- Ответы по базе знаний (RAG)
- Тексты и письма на русском
- Размеры
- 0.5B – 24B
- Железо
- от: Ноутбук
ТекстGGUF2023–2025
Inception (G42), MBZUAI и Cerebras · ОАЭ
Семейство моделей для арабского и английского языков, включая диалекты Персидского залива. Подходит компаниям, работающим с арабоязычными клиентами и госструктурами региона.
- Чат-бот на арабском и английском
- Перевод и пересказ документов на арабском
- Классификация обращений клиентов
- Размеры
- 256M – 70B
- Железо
- от: Ноутбук
Табличные данныеGGUF2024–2025
Чжэцзянский университет · Китай
Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.
- Ответы на вопросы по таблицам и выгрузкам
- Автоматический разбор данных с написанием кода
- Помощник в BI и внутренней отчётности
- Размеры
- 7B – 72B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2024–2025
DeepSeek · Китай
Математические модели DeepSeek. Первая версия 7B ввела метод обучения GRPO, V2 на 685B пишет и сама проверяет доказательства уровня олимпиад.
- Расчёты и проверка формул
- Проверка математических выкладок в отчётах
- Разбор задач по шагам
- Размеры
- 7B – 685B
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Nous Research · США
Дообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.
- Агенты, вызывающие функции и API
- Извлечение данных в строгом формате JSON
- Ассистент с гибкой настройкой роли и тона
- Размеры
- 3B – 405B
- Железо
- от: Ноутбук
ТекстOllama2025
Deep Cogito · США
Дообученные Llama, Qwen и DeepSeek с гибридным режимом: модель отвечает сразу или сначала рассуждает. Флагман v2.1 на 671B тратит на рассуждения заметно меньше токенов, чем DeepSeek R1.
- Чат-ассистент с режимом рассуждений
- Написание кода и вызов инструментов
- Ответы на сложные вопросы по документам
- Размеры
- 3B – 671B
- Железо
- от: Ноутбук
ТекстRU2025
Авито Тех · Россия
Модель Авито на базе Qwen3-8B, переученная под русский язык: свой токенизатор, русские тексты быстрее на 15–25%. Умеет вызывать функции.
- Описания товаров и объявлений на русском
- Чат-бот с вызовом внутренних сервисов
- Разбор и классификация обращений
- Размеры
- 7.9B
- Железо
- от: Ноутбук
ТекстOllama2025
OpenAI · США
Первые открытые модели OpenAI со времён GPT-2. Рассуждения, вызов инструментов, младшая версия помещается на одну видеокарту.
- ИИ-агент с вызовом внутренних систем
- Ответы по регламентам
- Черновики писем и отчётов
- Размеры
- 20B, 120B
- Железо
- от: 1 видеокарта
ТекстRU2024–2025
НИВЦ МГУ, лаборатория LAIR (RefalMachine) · Россия
Модели Qwen, переделанные под русский язык: заменён токенизатор и проведено дообучение на русских текстах. За счёт этого русский текст генерируется до двух раз быстрее, чем у исходной модели того же размера.
- Русскоязычный ассистент на своём сервере
- Ответы по документам компании (RAG) на русском
- Разбор и пересказ длинных русских текстов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
ТекстGGUF2025
ByteDance · Китай
Открытая модель ByteDance на 36B с контекстом до 512 тыс. токенов и настраиваемым «бюджетом размышлений». Помещается на одну мощную видеокарту.
- Разбор длинных документов
- Агенты с инструментами
- Корпоративный ассистент
- Размеры
- 36B
- Железо
- от: 1 видеокарта
Текст2024–2025
xAI · США
xAI выкладывает веса прошлых поколений Grok. Модели очень большие и требуют кластера видеокарт, поэтому на практике их запускают редко.
- Исследования больших моделей
- Ассистент на собственной инфраструктуре
- Генерация и анализ текстов
- Размеры
- 314B (Grok-1), Grok-2 крупнее
- Железо
- от: Кластер
МедицинаGGUF2025
Intelligent Internet · Великобритания
Рассуждающие медицинские модели на Qwen3, которые рассчитаны на запуск на обычном компьютере. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу с ходом рассуждения
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
ТекстRUOllama2024–2025
Hugging Face · США
Крошечные открытые модели Hugging Face для телефонов и ноутбуков. SmolLM3 на 3B умеет рассуждать и держит длинный контекст, весь рецепт обучения открыт.
- Простой ассистент прямо на устройстве
- Классификация и маршрутизация обращений
- Основа для дообучения под узкую задачу
- Размеры
- 135M – 3B
- Железо
- от: Ноутбук
Математика и рассуждения2025
NVIDIA · США
Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Разбор задач по программированию
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
ПереводRUGGUF2024–2025
Unbabel · Португалия
Языковые модели, заточенные под перевод и работу с многоязычными текстами: перевод, правка, оценка качества перевода. Русский есть. Некоммерческая лицензия.
- Перевод с учётом контекста и терминов
- Редактура машинного перевода
- Оценка качества готового перевода
- Размеры
- 2B – 72B
- Железо
- от: Ноутбук
КибербезопасностьGGUF2023–2025
Clouditera · Китай
Китайское открытое семейство для кибербезопасности: разбор уязвимостей, анализ логов и трафика, объяснение команд и скриптов.
- Разбор уязвимостей и подготовка рекомендаций по исправлению
- Анализ логов и восстановление цепочки атаки
- Объяснение подозрительных команд и скриптов
- Размеры
- 1.5B – 14B
- Железо
- от: Ноутбук
КибербезопасностьGGUF2025
Trendyol · Турция
Модели безопасности от крупного турецкого маркетплейса, выложены в формате GGUF: разбор алертов и инцидентов, английский и турецкий языки.
- Разбор алертов и первичная оценка инцидента
- Объяснение подозрительной активности в отчётах
- Помощь дежурной смене центра мониторинга
- Размеры
- 32B и 70B
- Железо
- от: 1 видеокарта
ТекстOllama2025
DeepSeek · Китай
Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.
- Сложные расчёты и проверка логики
- Анализ договоров и регламентов
- Помощь программистам
- Размеры
- 1,5B – 671B
- Железо
- от: Ноутбук
КодRU2025
МТС AI (MWS AI) · Россия
Маленький помощник программиста от МТС AI, понимает запросы на русском. Работает локально, есть плагины для VS Code и JetBrains.
- Подсказки и дописывание кода в редакторе
- Объяснение кода на русском
- Черновики тестов и документации
- Размеры
- 1.5B
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Meta · США
Модели, с которых начался массовый open source в ИИ. Огромная экосистема дообученных версий и инструментов.
- Ассистент для сотрудников
- Суммаризация встреч и документов
- Основа для дообучения под отрасль
- Размеры
- 1B – 405B
- Железо
- от: Ноутбук
ТекстRUGGUF2023–2025
Илья Гусев (IlyaGusev) · Россия
Самая известная русскоязычная доучка сообщества: чужие открытые модели (Llama, Mistral, Gemma, YandexGPT) дообучены отвечать на русском как ассистент. Удобная отправная точка для русского чат-бота на своём сервере.
- Чат-ассистент на русском языке
- Ответы на вопросы по базе знаний компании
- Черновики писем, описаний и постов на русском
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики договоров и регламентов
- Размеры
- 32B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Стэнфордский университет · США
Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.
- Расчёты и проверка формул
- Разбор сложных задач по шагам
- Обучение
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
Qihoo 360 · Китай
Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Агенты для компьютера2024–2025
Salesforce · США
Модели Salesforce для вызова функций и работы агентов: выбирают нужный инструмент и заполняют его параметры. Сильны в тестах, но лицензия некоммерческая.
- Вызов API и внутренних сервисов по запросу пользователя
- Агенты с несколькими шагами и инструментами
- Сравнение подходов перед выбором коммерческой модели
- Размеры
- 1B – 8x22B
- Железо
- от: Ноутбук
Финансы2025
Шанхайский университет финансов и экономики (SUFE) · Китай
Модель с рассуждениями для финансовых задач на базе Qwen2.5-7B: расчёты, разбор отчётов, вопросы по регулированию. Обучена на китайских и английских данных.
- Финансовые расчёты с пошаговым объяснением
- Ответы на вопросы по отчётности
- Разбор таблиц с финансовыми данными
- Размеры
- 7B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
NovaSky (Sky Computing Lab, Беркли) · США
Рассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
ТекстOllama2023–2025
Ai2 · США
Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.
- Ассистент для сотрудников на своём сервере
- Математика и точное следование инструкциям
- Образец рецепта для собственного дообучения
- Размеры
- 7B – 405B
- Железо
- от: Ноутбук
Кибербезопасность2025
Trend Micro · Япония
Модели Trend Micro для кибербезопасности на базе Llama 3.1 8B, дообученные на корпусе текстов по ИБ. Есть версия с рассуждениями.
- Ответы на вопросы по угрозам и уязвимостям
- Разбор отчётов о кибератаках
- Основа для дообучения под задачи SOC
- Размеры
- 8B
- Железо
- от: Ноутбук
ТекстGGUF2025
HUMAIN (ранее SDAIA) · Саудовская Аравия
Саудовская модель для арабского и английского языков, обученная с нуля. В открытом доступе одна версия на 7B.
- Ассистент на арабском языке
- Ответы на вопросы по документам
- Генерация и редактирование текстов на арабском
- Размеры
- 7B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.
- Расчёты и проверка формул
- Проверка расчётов в сметах и отчётах
- Разбор задач по шагам
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Финансы2023–2024
Du Xiaoman (Duxiaoman-DI) · Китай
Крупное китайское семейство моделей для финансовой отрасли: консультации, разбор документов и длинные тексты до 8k–16k. Не инвестиционная рекомендация: решения принимает специалист.
- Ответы на вопросы клиентов по банковским продуктам
- Разбор длинных финансовых документов
- Внутренний помощник по регламентам финансовой компании
- Размеры
- 6B – 176B
- Железо
- от: 1 видеокарта
ТекстOllama2024
Nexusflow · США
Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.
- Исследование агентов и вызова функций
- Сравнение с коммерческими моделями
- Эксперименты с чат-ассистентом
- Размеры
- 70B – 72B
- Железо
- от: 1 видеокарта
ТекстRU2024
МТС AI (MWS AI) · Россия
Лёгкая русскоязычная модель от МТС AI для текстов на русском: ответы, пересказ, черновики. Есть готовая версия для процессора без видеокарты. Старшая Cotype Pro открыто не выложена.
- Черновики писем и описаний на русском
- Краткий пересказ документов
- Ответы на типовые вопросы клиентов
- Размеры
- 1.5B
- Железо
- от: Ноутбук
Финансы2023–2024
The Fin AI / ChanceFocus · международный проект
Одно из первых открытых семейств моделей для финансового текста: разбор отчётности, новостей и вопросов по цифрам. Не инвестиционная рекомендация: решения принимает специалист.
- Разбор финансовой отчётности и пресс-релизов
- Ответы на вопросы по числовым данным из документов
- Классификация финансовых текстов
- Размеры
- 0.5B – 30B
- Железо
- от: Ноутбук
Финансы2023–2024
AI4Finance Foundation · США
Открытый набор лёгких надстроек к обычным языковым моделям для работы с финансовыми текстами и новостями. Не инвестиционная рекомендация: решения принимает специалист.
- Оценка тона финансовых новостей и отчётов
- Разметка упоминаний компаний и инструментов в тексте
- Подготовка сводок по потоку деловых новостей
- Размеры
- адаптеры к базовым моделям 6B – 20B
- Железо
- от: 1 видеокарта
ТекстOllamaНе развивается2023–2024
Stability AI · Великобритания
Малые модели Stability AI: StableLM 2 на 1.6B знает 7 европейских языков, Stable Code на 3B дописывает код. Обновлений с 2024 года нет.
- Лёгкий чат-бот на обычном ПК
- Автодополнение кода в редакторе
- Основа для дообучения под свою задачу
- Размеры
- 1.6B – 12B
- Железо
- от: Ноутбук
МедицинаGGUFНе развивается2023–2024
M42 Health · ОАЭ
Клинические модели абу-дабийской M42 на основе Llama, настроенные отвечать на медицинские вопросы. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу по клиническим вопросам
- Черновики выписок и писем для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 8B – 70B
- Железо
- от: Ноутбук
ФинансыНе развивается2024
Writer · США
Крупная модель под финансовые документы с окном контекста около 131 тыс. токенов: держит длинные отчёты целиком. Не инвестиционная рекомендация: решения принимает специалист.
- Работа с длинными годовыми отчётами и проспектами
- Сводки и выжимки по финансовым документам
- Поиск ответов внутри большого пакета документов
- Размеры
- 70B (в карточке указано 72 млрд параметров)
- Железо
- от: Кластер
ТекстOllamaНе развивается2023–2024
OpenChat (Университет Цинхуа) · Китай
Дообучения Mistral 7B и Llama 3 8B по методу C-RLFT, которые в 2023–2024 годах догоняли ChatGPT-3.5 при размере 7–8B. Лёгкий универсальный ассистент для слабого сервера.
- Чат-ассистент на недорогом сервере
- Черновики писем и ответов
- Помощь с простым кодом
- Размеры
- 7B – 13B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
01.AI · Китай
Двуязычные (английский и китайский) модели 01.AI на 6–34B с версиями на контекст до 200 тыс. токенов. Новых открытых выпусков с 2024 года нет.
- Чат-ассистент на одной видеокарте
- Разбор длинных документов
- Классификация и извлечение данных из текста
- Размеры
- 6B – 34B
- Железо
- от: Ноутбук
ТекстНе развивается2024
Equall · Франция
Языковые модели для юридических текстов, дообученные на базах права США и Европы (основа Mistral и Mixtral). Только английский.
- Разбор договоров на английском
- Поиск рисков и нестандартных условий
- Черновики юридических справок
- Размеры
- 7B – 141B
- Железо
- от: Ноутбук
МедицинаGGUFНе развивается2024
Авиньонский университет и Нантский университет · Франция
Mistral 7B, дообученная на статьях PubMed Central, плюс несколько слияний с общей моделью. Компактная и простая в запуске. Не заменяет врача, решения принимает специалист.
- Поиск и пересказ медицинских статей
- Черновики справочных материалов для персонала
- Разбор медицинской терминологии
- Размеры
- 7B
- Железо
- от: Ноутбук
МедицинаGGUFНе развивается2024
Saama AI Research · Индия
Llama 3, дообученная на медицинских и биологических данных. Одна из первых сильных открытых медицинских моделей 2024 года. Не заменяет врача, решения принимает специалист.
- Извлечение данных из медицинских документов
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 8B, 70B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
Hugging Face (H4) · США
Учебные чат-модели Hugging Face на базе Mistral, Gemma и Mixtral с открытым рецептом дообучения. Zephyr 7B Beta показал, что маленькую модель можно «воспитать» до уровня крупных без ручной разметки людьми.
- Лёгкий чат-ассистент
- Образец и отправная точка для своего дообучения
- Черновики текстов и ответов
- Размеры
- 7B – 141B-A35B
- Железо
- от: Ноутбук
ТекстRUНе развивается2023–2024
Сбер (ai-forever) · Россия
Русская модель «текст в текст» от Сбера, наследница ruT5 (2021). Небольшая и быстрая: её дообучают на пересказ, перефразирование и исправление ошибок в русском тексте, есть готовые версии проверки орфографии SAGE.
- Исправление орфографии и опечаток в русском тексте
- Краткий пересказ и перефразирование
- Нормализация заявок и обращений перед обработкой
- Размеры
- 95M – 1.7B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
TinyLlama (исследователи SUTD) · Сингапур
Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.
- Простые чат-боты на слабом железе
- Эксперименты и обучение команды
- Основа для дообучения под узкую задачу
- Размеры
- 1.1B
- Железо
- от: Ноутбук
КибербезопасностьGGUFНе развивается2023–2024
ZySec AI · Индия
Небольшой открытый помощник для специалистов по безопасности: вопросы по стандартам, разбор угроз и уязвимостей, подготовка внутренних документов.
- Ответы на вопросы по политикам и стандартам безопасности
- Первичный разбор сообщений об угрозах
- Черновики внутренних инструкций по защите
- Размеры
- 2.8B и 7B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
WizardLM (Microsoft и Пекинский университет) · США / Китай
Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.
- Сложные многошаговые инструкции
- Помощь программистам
- Решение математических задач
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
Intel · США
Дообученная Mistral 7B от Intel, показывавшая обучение и запуск на процессорах и ускорителях Intel. Устарела, интересна как пример оптимизации под железо Intel.
- Простой чат-ассистент
- Эксперименты с запуском на железе Intel
- Основа для дообучения
- Размеры
- 7B
- Железо
- от: Ноутбук
ФинансыGGUFНе развивается2023
AdaptLLM · не раскрыта
Дообученные под финансы версии Llama 2: разбор отраслевых текстов, отчётов и вопросов по терминам. Не инвестиционная рекомендация: решения принимает специалист.
- Разбор финансовых новостей и отчётов
- Ответы на вопросы по финансовой терминологии
- Основа для дообучения под свою финансовую задачу
- Размеры
- 7B и 13B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
Microsoft Research · США
Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.
- Исследования методов рассуждения
- Сравнение с современными малыми моделями
- Обучение специалистов
- Размеры
- 7B – 13B
- Железо
- от: Ноутбук
Табличные данныеНе развивается2023
OSU NLP Group, Университет штата Огайо · США
Универсальная модель по таблицам: заполнение пропусков, поиск строк, сопоставление колонок и ответы на вопросы по данным.
- Ответы на вопросы по таблицам из документов
- Сопоставление колонок разных таблиц
- Поиск и дополнение записей в справочниках
- Размеры
- 7B
- Железо
- от: Ноутбук
Разбор текстаНе развивается2022–2023
Mike Zhang, Rob van der Goot, Barbara Plank (IT University of Copenhagen и LMU Munich) · Дания
Научная линейка моделей для текстов рынка труда: обучены на объявлениях о работе и европейском справочнике профессий ESCO, вытаскивают из вакансий навыки и требования. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Извлечение навыков и требований из текста вакансии
- Приведение навыков к единому справочнику ESCO
- Классификация вакансий и должностей
- Размеры
- 110M – 560M
- Железо
- от: Ноутбук
ФинансыНе развивается2023
Fudan-DISC, Университет Фудань · Китай
Финансовый помощник из нескольких дообученных экспертов: консультации, расчёты, разбор документов и поиск по базе знаний. Не инвестиционная рекомендация: решения принимает специалист.
- Консультации по финансовым вопросам внутри компании
- Разбор финансовых документов и новостей
- Подсказки сотрудникам фронт-офиса
- Размеры
- 13B
- Железо
- от: 1 видеокарта
МедицинаНе развивается2023
Лаборатория Бо Ванга (Университет Торонто, Vector Institute) · Канада
Ранняя медицинская модель на Llama 2 70B, обученная на диалогах по медицинским текстам. Сейчас интересна в основном для исследований. Не заменяет врача, решения принимает специалист.
- Исследовательские пилоты по медицинским диалогам
- Учебные материалы для персонала
- Сравнение с новыми медицинскими моделями
- Размеры
- 70B
- Железо
- от: 1 видеокарта
ТекстRUGGUFНе развивается2022–2023
Сбер (ai-forever) · Россия
Многоязычная модель Сбера на 61 язык, включая языки народов России и СНГ. Есть отдельные доучки под бурятский, якутский, татарский, башкирский, казахский и другие языки — редкость для открытых моделей.
- Тексты на языках народов России и СНГ
- Основа для дообучения под редкий язык
- Черновики и шаблоны на нескольких языках
- Размеры
- 1.3B – 13B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
LMSYS (Беркли и партнёры) · США
Одна из первых открытых чат-моделей 2023 года: LLaMA, дообученная на диалогах пользователей ChatGPT. Историческая веха, сегодня уступает любой современной модели того же размера.
- Эксперименты и обучение команды
- Простой чат-ассистент для тестов
- Сравнение с новыми моделями
- Размеры
- 7B – 33B
- Железо
- от: Ноутбук
ТекстRUGGUFНе развивается2023
Сбер (ai-forever) · Россия
Базовая русскоязычная модель Сбера на 13 млрд параметров, из дообученной версии которой вырос GigaChat. Продолжает тексты на русском и английском, контекст всего 2048 токенов; сегодня интересна как основа для узкого дообучения.
- Основа для дообучения под узкую русскую задачу
- Генерация шаблонных русских текстов
- Эксперименты с русскоязычными моделями без ограничений лицензии
- Размеры
- 13B
- Железо
- от: 1 видеокарта
ТекстНе развивается2022–2023
Google · США
Компактные модели «вход-выход», обученные выполнять инструкции. До сих пор используются как дешёвая основа для классификации, извлечения и коротких ответов.
- Классификация обращений и документов
- Извлечение полей из текста
- Короткие ответы и пересказ
- Размеры
- 80M – 20B
- Железо
- от: Ноутбук
ТекстНе развивается2022–2023
EleutherAI · США
Полностью открытые модели некоммерческой лаборатории EleutherAI: GPT-NeoX-20B и серия Pythia с опубликованными промежуточными снимками обучения.
- Базовая модель для дообучения
- Исследование поведения моделей
- Простая генерация и дополнение текста
- Размеры
- 70M – 20B
- Железо
- от: Ноутбук
ТекстНе развивается2022
Meta · США
Ранняя открытая серия Meta, повторяющая по размерам GPT-3. Устарела, полезна для исследований и сравнения.
- Исследовательские эксперименты
- Обучение специалистов
- Сравнение с современными моделями
- Размеры
- 125M – 66B (175B по запросу)
- Железо
- от: Ноутбук
ТекстGGUFНе развивается2022
BigScience (Hugging Face и сообщество) · Франция
Одна из первых больших открытых моделей, обученная сообществом из сотен исследователей на 46 языках. Сегодня интересна скорее как историческая веха.
- Генерация и перевод текстов на многих языках
- Эксперименты и обучение команды
- Базовая модель для дообучения под узкую задачу
- Размеры
- 560M – 176B
- Железо
- от: Ноутбук