Нейросети для науки и исследований

Исследователям открытые модели помогают работать с белками и молекулами, климатическими и геоданными, математикой и научными статьями. Открытые веса позволяют воспроизводить результаты и дообучать модели под свою задачу. Смотрите на лицензию, ведь у части моделей есть ограничения для коммерции, и на требования к вычислениям.

В подборке 159 семейств открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
МедицинаGGUF2023–2026

HuatuoGPT

FreedomIntelligence (Китайский университет Гонконга, Шэньчжэнь) · Китай

Большое семейство медицинских моделей: чат, версия со снимками, рассуждающая HuatuoGPT-o1 и новая HuatuoGPT-3 на Qwen3. Не заменяет врача, решения принимает специалист.

  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
  • Подсказки при разборе снимков для врача (Vision)
Размеры
7B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllama2023–2026

InternLM / Intern-S

Shanghai AI Laboratory · Китай

Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.

  • Помощник исследователя: статьи, формулы, данные
  • Разбор научных и технических документов
  • Корпоративный чат на малых моделях
Размеры
1.8B – около 1T
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

MiMo

Xiaomi · Китай

Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.

  • Логические и расчётные задачи
  • Агенты с инструментами
  • Помощь программистам
Размеры
7B – 1,02T-A42B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Текст2024–2026

K2 (K2-Think, K2-V2, K2-Horizon)

MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ

Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.

  • Рассуждения, математика и технические вопросы
  • Разбор длинных документов
  • Агенты и написание кода
Размеры
0.9B – 375B-A23B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

LLaDA

Жэньминьский университет (GSAI) и Ant Group (inclusionAI) · Китай

Диффузионные языковые модели: текст пишется не по одному слову, а сразу блоками с последующим уточнением, что ускоряет генерацию. LLaDA2.2 умеет править уже написанное и рассчитана на агентов. Генератор картинок LLaDA-Image — отдельный продукт.

  • Быстрая генерация кода и текстов
  • Агентные сценарии с длинным контекстом
  • Исследования альтернатив обычным LLM
Размеры
8B – 100B (MoE)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
3D2024–2026

DUSt3R / MASt3R

NAVER LABS Europe · Франция (NAVER, Южная Корея)

Семейство, с которого началась 3D-реконструкция «в один проход» по паре или набору фото без калибровки камер. MASt3R добавил сопоставление точек и масштаб, MUSt3R и BLASt3R — работу с видео.

  • 3D-сцена по нескольким фото без калибровки
  • Сопоставление точек между снимками
  • Построение карты по видео (SLAM)
Размеры
0.57B – 0.69B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Музыка и звукGGUF2022–2026

MERT

m-a-p (Multimodal Art Projection) · Великобритания / Китай

Энкодер музыки: превращает трек в числовое описание, по которому определяют жанр, настроение, тональность и ритм. MERT-v2 работает с целыми песнями до 6 минут.

  • Автоматическая разметка музыкального каталога
  • Поиск похожих треков
  • Определение жанра, настроения и темпа
Размеры
95M – 632M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Автономное вождение2020–2026

comma.ai openpilot (supercombo)

comma.ai · США

Открытая система помощи водителю: нейросеть по камере держит полосу и управляет скоростью, плюс модель контроля внимания водителя. Модели лежат прямо в репозитории и обновляются постоянно.

  • Исследовательский стенд систем помощи водителю
  • Изучение контроля внимания водителя по камере в салоне
  • Сравнение со своими алгоритмами удержания полосы
Размеры
компактная, рассчитана на бортовое устройство
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2026

Zarya (ai-forever)

SberDevices (ai-forever) · Россия

Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.

  • Эксперименты с ускорением генерации
  • Дообучение небольших моделей под свои задачи
  • Исследования
Размеры
0.6B – 4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Документы и OCR2026

jina-ocr-v1

Jina AI · Германия

Разбор документов одной моделью: страница целиком превращается в Markdown — текст в правильном порядке чтения, таблицы и формулы в LaTeX. Построена на DeepSeek-OCR, активны только 0,6 млрд параметров из 3,4.

  • Перевод сканов и PDF в Markdown
  • Распознавание таблиц и формул
  • Разбор счетов, актов и отчётов
Размеры
3.4B-A0.6B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Голосовые ассистенты2026

Samsone

Samsung · Южная Корея

Крошечные модели понимания звука для смартфона: слушают речь, музыку и звуки вокруг и отвечают текстом — описывают запись и отвечают на вопросы о ней. Работают прямо на устройстве, вопросы и ответы — на английском: других языков в обучающих данных нет.

  • Описание аудиозаписи словами
  • Ответы на вопросы о звуке
  • Определение типа звука и обстановки
Размеры
99M – 356M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Компьютерное зрение2024–2026

MoGe

Microsoft Research · США

Восстанавливает 3D-геометрию сцены по одной фотографии: глубину в метрах, облако точек и нормали поверхностей.

  • Замеры помещений и объектов по фото
  • 3D-облако точек из снимка
  • Подготовка данных для роботов и AR
Размеры
ViT-S – ViT-G
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Роботы2025–2026

GigaBrain

GigaAI · Китай

Модель управления роботами, обученная в основном на синтетических данных из модели мира. Позволяет меньше тратить на сбор данных с реальных роботов.

  • Управление манипулятором
  • Дообучение на малом объёме своих данных
  • Пилоты сортировки и сборки
Размеры
3.5B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстOllama2024–2026

NVIDIA Nemotron

NVIDIA · США

Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).

  • Агенты с вызовом инструментов
  • Задачи с рассуждением и расчётами
  • Ответы по длинным документам
Размеры
4B – 550B-A55B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Погода и климат2024–2026

Ai2 ACE2 (климатический эмулятор)

Allen Institute for AI (Ai2) · США

Быстрый эмулятор климатической модели: моделирует атмосферу на годы и десятилетия вперёд на одной видеокарте. Есть связка с океаном (SamudrACE) для долгосрочных сценариев.

  • Сценарии климата на десятилетия для оценки долгосрочных рисков активов
  • Массовые расчёты «что если» по температуре и осадкам
  • Подготовка данных для моделей урожайности и спроса на энергию
Размеры
чекпоинт около 1,8 ГБ
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Погода и климат2023–2026

Google DeepMind GraphCast / GenCast / WeatherNext 2

Google DeepMind · Великобритания

Семейство глобальных погодных моделей Google DeepMind: GraphCast (прогноз на 10 дней), GenCast (ансамбль вероятностей) и WeatherNext 2 с прогнозом циклонов. С августа 2026 веса разрешены для коммерции.

  • Среднесрочный прогноз погоды для планирования смен, рейсов и поставок
  • Вероятностная оценка экстремальной погоды для страховых портфелей
  • Прогноз траекторий тропических циклонов для морских и портовых операций
Размеры
от облегчённых версий 1° до полных 0,25°
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Биология и химия2022–2026

OpenFold / OpenFold3

Лаборатория AlQuraishi (Колумбийский университет) и консорциум OpenFold · США

Полностью открытое воспроизведение AlphaFold 2, а затем AlphaFold 3 под Apache 2.0 с обучающими данными. OpenFold3 предсказывает комплексы белков, нуклеиновых кислот и лигандов.

  • Предсказание структуры белков и комплексов с лигандами
  • Дообучение на собственных данных компании (код обучения открыт)
  • Внутренний сервис структурного анализа без передачи данных наружу
Размеры
один набор весов на версию
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Автономное вождение2025–2026

NVIDIA Alpamayo

NVIDIA · США

Модели «зрение–язык–действие» для беспилотников: по видео с камер строят траекторию и объясняют решение текстом. Используются для разработки и проверки систем автопилота, а не как готовый автопилот.

  • Авторазметка записей с камер для обучения своих систем помощи водителю
  • Разбор сложных дорожных сцен с текстовым объяснением
  • Проверка систем автопилота в симуляторе на редких сценариях
Размеры
10B – 34B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Автономное вождение2026

Qwen-Drive

Alibaba (команда Qwen) · Китай

Модель для автономного вождения на базе Qwen3.5-4B: 3D-распознавание объектов вокруг машины, ответы на вопросы о дорожной сцене и планирование траектории в одной модели.

  • Прототип восприятия и планирования для беспилотной техники на закрытой территории
  • Ответы на вопросы о записях с камер при разборе инцидентов
  • Разметка дорожных сцен для обучения своих моделей
Размеры
4B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Детекция подделок2023–2026

UniversalFakeDetect

University of Wisconsin-Madison · США

Ранний и до сих пор используемый подход: поверх замороженного CLIP обучается простой классификатор, который переносится на незнакомые генераторы. Ошибается в обе стороны — вывод требует проверки человеком.

  • Проверка изображений от новых, незнакомых генераторов
  • Базовая линия при сравнении детекторов
  • Быстрое внедрение проверки без дообучения крупной модели
Размеры
линейный классификатор поверх CLIP ViT-L/14
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Роботы2025–2026

NVIDIA Cosmos

NVIDIA · США

Модели «мира» для роботов и беспилотников: генерируют реалистичное видео физических сцен и предсказывают действия. Cosmos 3 объединяет понимание, генерацию и управление.

  • Синтетические видео для обучения роботов и беспилотников
  • Проверка сценариев в симуляции
  • Управление роботом (Policy-версии)
Размеры
2B – 65B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Роботы2026

LingBot-VLA

Ant Group (Robbyant) · Китай

Модель управления роботами от Ant Group, обученная на большом объёме данных с реальных роботов. Версия 2.0 работает с разными типами манипуляторов.

  • Управление двуруким манипулятором
  • Дообучение под свою операцию
  • Пилоты сборки и сортировки
Размеры
4B – 6B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Роботы2026

Xiaomi Robotics

Xiaomi · Китай

Открытые модели управления роботами от Xiaomi. Robotics-1 рассчитана на бытовые и кухонные задачи, U0 объединяет понимание сцены и действия.

  • Управление манипулятором по команде
  • Бытовые и сервисные сценарии
  • Основа для дообучения
Размеры
4B – 5B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстGGUF2025–2026

Kimi

Moonshot AI · Китай

Сверхкрупные MoE-модели Moonshot для агентной работы. K3 на 2,8 трлн параметров — самая большая открытая модель на момент выхода, с контекстом до 1 млн токенов и пониманием картинок; K2.7-Code заточена под программирование.

  • Многошаговые агенты: поиск, сбор данных, отчёты
  • Глубокий анализ документов
  • Помощь программистам
Размеры
16B-A3B – 2.8T-A104B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllama2024–2026

EXAONE

LG AI Research · Южная Корея

Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.

  • Корпоративный ассистент
  • Работа с корейскими и английскими текстами
  • Разбор документов и картинок (4.5)
Размеры
1.2B – 750B-A37B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстGGUF2025–2026

Apertus

Swiss AI (ETH Zurich, EPFL, CSCS) · Швейцария

Государственная открытая модель Швейцарии: открыты веса, данные и рецепт, более 1000 языков в обучении. Версия 1.5 понимает изображения.

  • Многоязычный ассистент
  • Ответы по документам
  • Разбор изображений и сканов (v1.5)
Размеры
0.5B – 70B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстGGUF2024–2026

Ovis

Alibaba (AIDC-AI) · Китай

Модели зрения от международного подразделения Alibaba с сильным чтением текста и таблиц. В линейке есть MoE Ovis2.6 и отдельные компактные OvisOCR для документов.

  • Извлечение данных из счетов, договоров и накладных
  • Распознавание таблиц
  • Ответы на вопросы по фото и графикам
Размеры
0.9B – 80B-A3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данные2026

EXAONE Tabular

LG AI Research · Южная Корея

Маленькая табличная модель LG: при 21M параметров почти догоняет лидеров по точности классификации и регрессии. Веса только для некоммерческого использования.

  • Пилотные прогнозы оттока
  • Проверка гипотез по скорингу
  • Исследование клиентских данных
Размеры
около 21M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Погода и климат2024–2026

Microsoft Aurora

Microsoft Research · США

Базовая модель атмосферы Земли: глобальный прогноз погоды, отдельные версии для качества воздуха и морских волн. Считает прогноз за секунды вместо часов на суперкомпьютере.

  • Собственный прогноз температуры, ветра и осадков по точкам присутствия компании
  • Оценка волнения моря для планирования рейсов и портовых работ
  • Прогноз загрязнения воздуха для промышленных площадок
Размеры
около 1,3B (есть малая версия для тестов)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Погода и климат2022–2026

NVIDIA FourCastNet и модели Earth-2

NVIDIA · США

Набор погодных и климатических моделей NVIDIA: глобальный прогноз FourCastNet, детализация до километров (CorrDiff), прогноз гроз по региону (StormCast), генерация климата (cBottle, Atlas). Запускаются через Earth2Studio.

  • Глобальный прогноз с последующей детализацией на нужный регион
  • Краткосрочный прогноз гроз и сильных осадков для диспетчерских служб
  • Генерация множества погодных сценариев для стресс-тестов
Размеры
98M – 2,5B (FourCastNet 3 — около 711M)
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
КартинкиGGUF2026

Ideogram 4

Ideogram · Канада

Открытые веса модели Ideogram, известной точной типографикой. Под некоммерческой лицензией: для бизнеса подходит только для тестов.

  • Тестирование генерации с текстом
  • Исследования и прототипы
Размеры
около 9B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Математика и рассужденияOllama2025–2026

OpenThinker

Open Thoughts (Стэнфорд, Беркли и другие университеты) · США

Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики регламентов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Табличные данные2026

TabFM

Google Research · США

Крупная табличная модель Google: классификация и регрессия по примерам без обучения, с числовыми и категориальными столбцами. Веса только для некоммерческого использования.

  • Пилотное сравнение с текущими моделями скоринга
  • Исследование данных о клиентах
  • Проверка гипотез по оттоку
Размеры
около 1.6B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Картинка + текст2023–2026

InternVideo

Shanghai AI Lab (OpenGVLab) · Китай

Семейство моделей для видео: энкодеры для поиска и классификации роликов и чат-модели, которые разбирают длинные видео. InternVideo 3 рассчитан на многочасовые записи.

  • Поиск по видеоархиву текстовым запросом
  • Распознавание действий на видео
  • Ответы на вопросы по длинной записи
Размеры
малые энкодеры – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Спутниковые снимки и гео2025–2026

Ai2 OlmoEarth

Allen Institute for AI (Ai2) · США

Семейство моделей для снимков Sentinel-1, Sentinel-2 и Landsat от Ai2, с готовыми дообучениями под мангры, вырубки и типы экосистем. Лицензия исключает добывающую отрасль.

  • Мониторинг вырубок и состояния лесов в цепочке поставок
  • Классификация угодий и культур по серии снимков
  • Эмбеддинги снимков для поиска похожих участков
Размеры
Nano – Large (Base около 114M)
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаOllama2023–2026

Meditron

EPFL · Швейцария

Открытые медицинские модели швейцарского EPFL, которые дообучают поверх разных базовых моделей по клиническим руководствам. Не заменяет врача, решения принимает специалист.

  • Ответы персоналу по клиническим руководствам
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
2B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Роботы2025–2026

MolmoAct

Ai2 (Allen Institute for AI) · США

Полностью открытая модель управления роботом, которая сначала «рассуждает» о пространстве и траектории, а потом действует. Ход рассуждений можно проверить.

  • Управление манипулятором с объяснимыми шагами
  • Дообучение под свой робот
  • Исследовательские пилоты
Размеры
5B – 8B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Картинка + текстOllama2023–2026

LLaVA

LLaVA / LMMs-Lab (исследователи из США и Китая) · США / Китай

Открытый проект, с которого пошла мода на модели «картинка + текст». Линейка OneVision понимает фото, документы и видео; открыты данные и рецепты обучения.

  • Ответы на вопросы по фото и скриншотам
  • Описание товаров по фотографии
  • Разбор видео по кадрам
Размеры
0.5B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Документы и OCRGGUF2025–2026

MinerU

Shanghai AI Laboratory (OpenDataLab) · Китай

Популярный открытый инструмент перевода PDF в Markdown со своей небольшой моделью. MinerU2.5-Pro улучшили только за счёт данных, без роста размера. Языки в карточке — китайский и английский.

  • Перевод PDF-отчётов и договоров в Markdown
  • Распознавание таблиц и формул
  • Подготовка документов для RAG и поиска
Размеры
0.9B – 1.2B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
3D2025–2026

VGGT

Meta и Оксфордский университет (VGG) · США / Великобритания

Восстанавливает 3D-сцену по одной, нескольким или сотням фотографий за секунды: положение камер, глубину и облако точек. Лучшая статья CVPR 2025.

  • 3D-модель помещения или объекта по серии фото
  • Определение положения камер для фотограмметрии
  • Облако точек для обмеров и сравнения с планом
Размеры
около 1.2B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Биология и химия2022–2026

ESM (ESM-2, ESM3, ESM C, ESMFold2)

EvolutionaryScale / Chan Zuckerberg Biohub (ESM-2 — Meta AI) · США

Языковые модели белков: понимают аминокислотные последовательности, предсказывают структуру (ESMFold2) и помогают в дизайне белков. С 2026 года все открытые версии под MIT.

  • Эмбеддинги белков для предсказания свойств (стабильность, растворимость)
  • Предсказание 3D-структуры белков и комплексов
  • Отбор кандидатов в дизайне ферментов и антител перед лабораторией
Размеры
8M – 15B (ESM-2), 300M – 6B (ESM C), 1,4B (открытая ESM3)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодOllama2025–2026

Rnj-1

Essential AI · США

Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.

  • Генерация и исправление кода
  • Агент-разработчик на одной видеокарте
  • Решение технических и научных задач
Размеры
8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голосовые ассистенты2024–2026

Audio Flamingo

NVIDIA · США

Модели, которые слушают речь, звуки и музыку и отвечают на вопросы о них. Audio Flamingo Next разбирает записи до 30 минут. Только для исследований.

  • Подробное описание аудиозаписей
  • Вопросы и ответы по длинной записи
  • Разметка музыки и звуков
Размеры
0.5B – 8B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Проверка фактов и оценка ответовRU2025–2026

POLLUX Judge (ai-forever)

SberDevices (ai-forever) · Россия

Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.

  • Автоматическая проверка качества ответов чат-бота на русском
  • Сравнение нескольких моделей перед выбором
  • Контроль ответов после дообучения
Размеры
4B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаGGUF2025–2026

Hulu-Med

Чжэцзянский университет · Китай

Медицинская модель для текста, снимков, 3D-исследований и видео: от лёгкой 4B до крупной MoE. Не заменяет врача, решения принимает специалист.

  • Подсказки при разборе снимков и КТ для врача
  • Черновики заключений и выписок
  • Поиск по медицинской литературе
Размеры
4B – 235B-A22B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025–2026

Goedel-Prover

Принстонский университет · США

Открытые модели для формальных доказательств в Lean 4 из Принстона. Свежая Goedel-Code-Prover доказывает корректность программ.

  • Формальная проверка математических выкладок
  • Проверка корректности кода
  • Обучение
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Роботы2025–2026

NVIDIA Isaac GR00T

NVIDIA · США

Базовая модель NVIDIA для человекоподобных роботов и манипуляторов: видит, понимает команду и выдаёт движения. Встроена в экосистему Isaac.

  • Управление человекоподобными роботами
  • Дообучение под свою роботизированную ячейку
  • Обучение в симуляции с переносом на реального робота
Размеры
2B – 3B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Синтез речиRU2024–2026

Fish Speech / OpenAudio

Fish Audio · США / Китай

Синтез речи с клонированием голоса и управлением эмоциями на 80+ языках, включая русский. Качество близко к платным сервисам, но веса только для исследований.

  • Клонирование голоса
  • Эмоциональная озвучка
  • Озвучка на многих языках
Размеры
0.5B – около 4.5B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Картинка + текстGGUF2023–2026

InternVL

Shanghai AI Laboratory (OpenGVLab) · Китай

Большая линейка китайских моделей зрения с размерами от 1B до 241B. InternVL-U (4B) объединяет понимание картинок, их генерацию и редактирование.

  • Понимание документов, схем и графиков
  • Ответы на вопросы по фото
  • Разбор видео
Размеры
1B – 241B-A28B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текст2024–2026

Molmo

Ai2 (Allen Institute for AI) · США

Полностью открытые модели зрения Ai2 (веса и данные). Умеют указывать точку на картинке и считать предметы; Molmo2 понимает видео, MolmoWeb управляет браузером.

  • Подсчёт товаров и объектов на фото
  • Указание, где на снимке нужный предмет
  • Разбор видео
Размеры
1B-A7B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRU2026

OmniVoice

k2-fsa (Next-gen Kaldi) · Китай

Синтез речи с клонированием голоса по короткому образцу на 646 языках, включая русский и языки народов России. Можно описать голос словами. Веса только для некоммерческого использования.

  • Озвучка на редких языках
  • Клонирование голоса по образцу
  • Исследования и прототипы многоязычной озвучки
Размеры
0.6B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Видео2025–2026

Matrix-Game

Skywork AI (Kunlun) · Китай

Интерактивная «модель мира»: генерирует видео игрового мира в реальном времени и реагирует на нажатия клавиш и мышь. Версия 3.0 держит память о сцене минутами.

  • Прототипы игровых миров без движка
  • Интерактивные демо и симуляции
  • Генерация данных для обучения агентов
Размеры
1.8B – 17B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Табличные данные2025–2026

Orion-MSP / Orion-BiX

Lexsi Labs · Индия

Свежие открытые модели для табличных данных: предсказывают по нескольким примерам прямо в запросе, без обучения под конкретную задачу.

  • Классификация и прогноз по таблицам без отдельного обучения
  • Быстрая проверка моделей на новых наборах данных
  • Оценка признаков в больших таблицах
Размеры
размер не указан в карточке
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Код2026

SERA (Ai2 Open Coding Agents)

Ai2 (Allen Institute for AI) · США

Полностью открытые агенты-разработчики от Ai2: открыты веса, данные и рецепт обучения. Задуманы так, чтобы компания могла дешево доучить агента на своём репозитории.

  • Агент для исправления задач в коде
  • Дообучение агента под внутренний репозиторий
  • Автоматизация мелких правок и тестов
Размеры
8B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2026

QED-Nano

LM Provers (CMU, Hugging Face, ETH Zurich, Project Numina) · США, Швейцария, Франция

Маленькая модель 4B на Qwen3, которая пишет математические доказательства на обычном языке почти на уровне больших моделей. Запускается на ноутбуке.

  • Проверка логики рассуждений и выкладок
  • Пошаговое объяснение решений
  • Обучение и олимпиадная подготовка
Размеры
4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Биология и химия2024–2026

Arc Institute Evo / Evo 2

Arc Institute (с Together AI, Stanford, NVIDIA) · США

Языковые модели ДНК с контекстом до миллиона нуклеотидов: оценивают влияние мутаций, аннотируют геномы и генерируют последовательности. Evo 2 обучена на геномах всех царств жизни.

  • Оценка вероятной вредности генетических вариантов для исследований
  • Аннотация геномов микроорганизмов и растений
  • Поиск перспективных последовательностей в селекции и синтетической биологии
Размеры
1B – 40B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
МедицинаOllama2025–2026

MedGemma

Google · США

Медицинская версия Gemma от Google: читает медицинские тексты и снимки (рентген, дерматология, гистология). Инструмент для врача и разработчика, не заменяет врача, решения принимает специалист.

  • Черновики выписок и заключений для проверки врачом
  • Подсказки при разборе снимков для врача
  • Поиск и пересказ медицинской литературы
Размеры
4B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Медицина2023–2026

CheXagent / CheXOne

Stanford AIMI · США

Стэнфордские модели для рентгена грудной клетки: описывают снимок и готовят черновик заключения. Не заменяет врача, решения принимает специалист.

  • Черновик описания рентгенограммы для врача-рентгенолога
  • Подсказки при разборе снимков для врача
  • Проверка полноты заключений
Размеры
3B – 8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаGGUF2025–2026

Lingshu

Alibaba DAMO Academy · Китай

Медицинская модель Alibaba на основе Qwen2.5-VL: понимает снимки разных типов и медицинский текст, умеет рассуждать по шагам. Не заменяет врача, решения принимает специалист.

  • Подсказки при разборе снимков для врача
  • Черновики заключений и выписок
  • Поиск по медицинской литературе
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаGGUF2025–2026

AntAngelMed

Ant Healthcare (Ant Group) и Центр медицинской информации провинции Чжэцзян · Китай

Крупная медицинская MoE-модель на базе Ling-flash-2.0: 100B параметров, из них в работе 6B, поэтому отвечает быстро. Не заменяет врача, решения принимает специалист.

  • Справочные ответы персоналу по клиническим вопросам
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
100B-A6B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстOllama2024–2026

OLMo

Allen Institute for AI (Ai2) · США

Полностью открытые модели: опубликованы не только веса, но и данные, код обучения и промежуточные снимки. Удобно, когда важна прозрачность происхождения.

  • Ассистент и ответы по документам
  • Задачи с рассуждением (версии Think)
  • Дообучение под свои данные с понятной историей модели
Размеры
1B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстGGUF2024–2026

INTELLECT

Prime Intellect · США

Модели, обученные распределённо на видеокартах со всего мира. INTELLECT-3 на 106B дообучена с подкреплением для математики, кода и агентов.

  • Задачи с рассуждением и математикой
  • Помощь в программировании
  • Агенты с вызовом инструментов
Размеры
10B – 106B-A12B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Погода и климат2024–2026

ECMWF AIFS

Европейский центр среднесрочных прогнозов погоды (ECMWF) · Европа (межправительственная организация)

Погодная нейросеть ECMWF, которая работает в оперативном режиме: прогноз на 15 дней четыре раза в сутки, ансамблевая версия на 51 сценарий, с версии 2 — волнение моря.

  • Собственный запуск прогноза от открытых начальных данных
  • Ансамблевые прогнозы для оценки вероятности заморозков, ливней, штормов
  • Прогноз волнения для морских операций
Размеры
чекпоинт около 1 ГБ
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Компьютерное зрениеGGUF2024–2025

Depth Anything

ByteDance и Гонконгский университет · Китай

Определяет глубину — расстояние до каждой точки — по одной обычной фотографии или видео. DA3 восстанавливает геометрию сцены с нескольких кадров.

  • Оценка расстояний и объёмов по камере
  • Эффекты глубины для фото и видео
  • Навигация роботов и дронов
Размеры
25M – 1.4B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Речь в текстRU2025

Omnilingual ASR

Meta · США

Распознавание речи на 1600+ языках, включая русский и редкие языки, которые раньше не поддерживала ни одна система. Новый язык можно добавить по нескольким примерам.

  • Расшифровка на редких и местных языках
  • Оцифровка устных архивов
  • Субтитры на многих языках
Размеры
300M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текст2023–2025

CogVLM и GLM-V

Zhipu AI (Z.ai) и Университет Цинхуа · Китай

Модели зрения от Zhipu: сначала CogVLM, затем линейка GLM-V. GLM-4.6V умеет вызывать инструменты по картинкам и работать как агент с интерфейсом.

  • Ответы на вопросы по фото и документам
  • Агент, работающий с интерфейсом по скриншотам
  • Разбор графиков и отчётов
Размеры
9B – 106B-A12B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
3D2025

MapAnything

Meta и Университет Карнеги — Меллон · США

Одна модель собирает метрическую 3D-реконструкцию из фото, а если есть данные о камерах, глубине или позах — учитывает и их. Есть версия весов под Apache 2.0.

  • 3D-реконструкция объекта или помещения по фото
  • Экспорт сцены в формат COLMAP для дальнейшей обработки
  • Оценка глубины и положения камер
Размеры
около 1.2B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
3D2025

Pi3 (π³)

Shanghai AI Lab · Китай

Восстанавливает 3D-сцену и положения камер по набору фото или видео, не опираясь на «опорный» кадр. Pi3X даёт более гладкие облака точек и примерный масштаб в метрах.

  • 3D-реконструкция сцены по видео
  • Оценка положения камеры по кадрам
  • Облака точек для исследований и прототипов
Размеры
0.96B – 1.4B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Математика и рассужденияGGUF2024–2025

DeepSeek-Math

DeepSeek · Китай

Математические модели DeepSeek. Первая версия 7B ввела метод обучения GRPO, V2 на 685B пишет и сама проверяет доказательства уровня олимпиад.

  • Расчёты и проверка формул
  • Проверка математических выкладок в отчётах
  • Разбор задач по шагам
Размеры
7B – 685B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
3DGGUF2025

SAM 3D

Meta · США

Восстанавливает 3D-форму предмета или тела человека по одной обычной фотографии, даже если объект частично закрыт. Две модели: Objects и Body.

  • 3D-модель предмета с фото из каталога
  • Оценка позы и формы тела по фото
  • Примерка и AR-сценарии
Размеры
н/д
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Спутниковые снимки и гео2025

IBM–ESA TerraMind

IBM и Европейское космическое агентство (ESA) · США / Европа

Мультимодальная модель Земли: понимает оптические и радарные снимки, рельеф, индекс растительности и карты землепользования, умеет достраивать недостающий тип данных (например, «снимок сквозь облака» по радару).

  • Анализ полей и лесов даже в облачную погоду по радарным снимкам
  • Карты землепользования для оценки участков
  • Оценка паводков и пожаров (есть готовые дообучения)
Размеры
tiny – large (чекпоинты от ~200 МБ до ~3,8 ГБ)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Компьютерное зрение2023–2025

MetaCLIP / MetaCLIP 2

Meta · США

Открытый повтор CLIP от Meta с прозрачным рецептом сбора данных. MetaCLIP 2 обучен на многоязычных данных со всего мира. Только некоммерческая лицензия.

  • Поиск картинок по тексту
  • Классификация изображений без обучения
  • Исследования и прототипы поиска
Размеры
0.15B – 3.6B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Документы и OCRGGUF2025

olmOCR

Ai2 (Allen Institute for AI) · США

Модель и набор инструментов для массового перевода PDF в чистый текст с сохранением порядка чтения, таблиц и формул. Рассчитана на обработку миллионов страниц.

  • Массовая оцифровка архива PDF
  • Распознавание договоров и отчётов в текст
  • Подготовка документов для поиска и RAG
Размеры
7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Биология и химия2024–2025

Boltz (Boltz-1, Boltz-2, BoltzGen)

MIT (Jameel Clinic) и Recursion · США

Открытая альтернатива AlphaFold 3 под MIT: предсказывает структуру комплексов белков, ДНК и малых молекул, Boltz-2 оценивает силу связывания, BoltzGen проектирует новые связывающие белки.

  • Предсказание, как молекула-кандидат садится в белок-мишень
  • Ранжирование соединений по прогнозу силы связывания до синтеза
  • Проектирование белков-связывателей под заданную мишень
Размеры
чекпоинты около 2 ГБ
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Детекция подделок2025

AntiDeepfake (NII)

National Institute of Informatics, Yamagishi Lab · Япония

Семь речевых энкодеров (wav2vec 2.0, XLS-R, MMS, HuBERT), дообученных различать живую и синтезированную речь. Разработчики сами отмечают: качество сильно зависит от набора данных, вывод проверяет человек.

  • Проверка аудиозаписей на синтез
  • Дообучение под свой язык и канал записи
  • Сравнение нескольких энкодеров на своих данных
Размеры
0,3B – 2B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Роботы2025

π0 / π0.5 (openpi)

Physical Intelligence · США

Модели управления роботами от Physical Intelligence: складывание белья, уборка, работа с предметами. π0.5 лучше справляется в незнакомой обстановке.

  • Управление манипуляторами и двуруким роботом
  • Дообучение под свои операции
  • Пилоты по автоматизации ручного труда
Размеры
около 3B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Спутниковые снимки и гео2023–2025

IBM–NASA Prithvi

IBM и NASA · США

Базовые модели для спутниковых снимков Landsat и Sentinel-2 с учётом серии снимков во времени. Есть готовые дообучения под наводнения, гари и типы культур, плюс отдельная погодная модель WxC.

  • Карта посевов и состояния полей по сезону
  • Оценка зон затопления и гарей после стихийных событий
  • Мониторинг изменений застройки и землепользования
Размеры
tiny – 600M (снимки), 2,3B (погода Prithvi WxC)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Kimina-Prover

Moonshot AI и Project Numina · Китай, Франция

Модели для формальных доказательств в Lean 4 от Moonshot AI (Kimi) и Numina. Есть маленькие версии от 0.6B, которые запускаются на ноутбуке.

  • Формальная проверка математических выкладок
  • Перевод задачи с обычного языка на Lean
  • Обучение и олимпиадная подготовка
Размеры
0.6B – 72B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Компьютерное зрение2023–2025

DINOv2 / DINOv3

Meta · США

Базовые модели, которые превращают картинку в числовой «отпечаток». На них строят поиск похожих изображений, классификацию и сегментацию без большой разметки.

  • Поиск похожих товаров и фото
  • Классификация изображений на малых данных
  • Основа для своих моделей контроля качества
Размеры
21M – 7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Текст2024–2025

Grok (открытые веса)

xAI · США

xAI выкладывает веса прошлых поколений Grok. Модели очень большие и требуют кластера видеокарт, поэтому на практике их запускают редко.

  • Исследования больших моделей
  • Ассистент на собственной инфраструктуре
  • Генерация и анализ текстов
Размеры
314B (Grok-1), Grok-2 крупнее
Железо
от: Кластер
Коммерция с условиямиПодробнее
Лица2025

LVFace

ByteDance · Китай

Распознавание лиц на трансформерах от ByteDance, одна из самых точных открытых моделей по тестам. Веса опубликованы в формате ONNX, но некоммерческие.

  • Сравнение лиц и поиск по базе фотографий
  • Исследование точности распознавания
  • Прототипы систем доступа
Размеры
ViT-T – ViT-L
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Медицина2025

MedSigLIP

Google · США

Лёгкий кодировщик медицинских снимков и текста от Google, тот же, что внутри MedGemma. Сортирует и ищет похожие снимки. Не заменяет врача, решения принимает специалист.

  • Поиск похожих снимков в архиве клиники
  • Предварительная сортировка снимков для врача
  • Основа для своих классификаторов снимков
Размеры
около 0.9B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаGGUF2025

II-Medical

Intelligent Internet · Великобритания

Рассуждающие медицинские модели на Qwen3, которые рассчитаны на запуск на обычном компьютере. Не заменяет врача, решения принимает специалист.

  • Справочные ответы персоналу с ходом рассуждения
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияOllama2025

DeepScaleR, DeepCoder, DeepSWE

Agentica (Беркли, Sky Computing Lab) и Together AI · США

Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.

  • Решение математических задач с пошаговым выводом
  • Генерация и проверка кода
  • Агент для исправления ошибок в репозитории
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответов2024–2025

CompassJudger / CompassVerifier

OpenCompass (Шанхайская лаборатория ИИ) · Китай

Линейка судей от команды открытых тестов моделей: оценивают ответы и сверяют их с эталоном. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.

  • Оценка ответов моделей по заданным критериям
  • Сверка ответа с эталонным решением
  • Сравнение нескольких моделей на своих данных
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассуждения2025

AceMath / AceReason

NVIDIA · США

Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Разбор задач по программированию
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Роботы2025

SmolVLA

Hugging Face · США

Маленькая модель управления роботом, которая работает на обычном ноутбуке. Обучена на открытых данных сообщества LeRobot, подходит для недорогих манипуляторов.

  • Управление недорогим манипулятором
  • Быстрые пилоты и демо роботизации
  • Обучение персонала и студентов
Размеры
450M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстGGUF2025

Kimi-VL

Moonshot AI · Китай

Экономичная MoE-модель зрения (16B, активны 3B) с длинным контекстом и рассуждающей версией. Хорошо разбирает длинные документы и видео.

  • Разбор длинных PDF и презентаций
  • Ответы на вопросы по видео
  • Работа с интерфейсами по скриншотам
Размеры
16B-A3B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Спутниковые снимки и гео2025

MBZUAI TerraFM

MBZUAI · ОАЭ

Компактная исследовательская модель для спутниковых снимков: обучена сразу на оптических (Sentinel-2) и радарных (Sentinel-1) данных. Меньше по охвату и сообществу, чем Prithvi и TerraMind.

  • Классификация и сегментация спутниковых снимков после дообучения
  • Основа для прототипа мониторинга территорий
Размеры
TerraFM-B (ViT-Base)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Детекция подделок2024–2025

AIDE

Xiaohongshu, USTC и Shanghai Jiao Tong University · Китай

Детектор ИИ-картинок из нескольких экспертов: одни смотрят на визуальные артефакты, другие на шум. Вместе с ним выпущен сложный набор Chameleon. Ошибается в обе стороны — итог проверяет человек.

  • Проверка реалистичных ИИ-изображений без явных артефактов
  • Сравнение детекторов на сложных примерах
  • Дообучение под свой тип контента
Размеры
несколько экспертов на базе ConvNeXt и CLIP
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllama2025

DeepSeek-R1

DeepSeek · Китай

Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.

  • Сложные расчёты и проверка логики
  • Анализ договоров и регламентов
  • Помощь программистам
Размеры
1,5B – 671B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КартинкиGGUF2025

BAGEL

ByteDance Seed · Китай

Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.

  • Редактирование фото в диалоге
  • Ответы на вопросы по изображению
  • Генерация картинок с пояснениями
Размеры
14B-A7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Финансы2025

Fino1 / Fin-o1

The Fin AI · международный проект

Модели, которые перед ответом проговаривают ход рассуждения по финансовым задачам с числами и таблицами. Не инвестиционная рекомендация: решения принимает специалист.

  • Расчётные вопросы по отчётности с показом хода решения
  • Разбор задач с таблицами и числами из документов
  • Проверка расчётов, сделанных вручную
Размеры
8B и 14B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Проверка фактов и оценка ответовRU2024–2025

Nemotron Reward / GenRM

NVIDIA · США

Крупные оценщики NVIDIA для отбора и дообучения ответов. У мультиязычной версии GenRM в списке языков есть русский. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.

  • Отбор лучшего ответа из нескольких вариантов
  • Подготовка данных для дообучения своей модели
  • Оценка ответов помощника на русском и других языках
Размеры
49B, 70B и 340B
Железо
от: Кластер
Коммерция с условиямиПодробнее
Математика и рассужденияGGUF2024–2025

DeepSeek-Prover

DeepSeek · Китай

Модели DeepSeek для формальных доказательств на языке Lean 4: доказательство проверяет программа, а не человек. Узкий инструмент для математиков и инженеров.

  • Формальная проверка математических выкладок
  • Проверка корректности алгоритмов
  • Обучение и олимпиадная подготовка
Размеры
7B – 671B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Видео2024–2025

Open-Sora

HPC-AI Tech · Сингапур

Полностью открытый проект видеогенерации: веса, код и рецепт обучения. Версия 2.0 на 11B делает видео из текста и из картинки.

  • Видео по текстовому описанию
  • Оживление картинок
  • Обучение своей видеомодели
Размеры
до 11B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Видео2025

Step-Video

StepFun · Китай

Крупная видеомодель на 30B с роликами до 204 кадров. Требует серверного железа, зато открыта под MIT.

  • Видео по описанию
  • Оживление изображений
Размеры
30B
Железо
от: Кластер
Можно в коммерциюПодробнее
Математика и рассужденияOllama2024–2025

QwQ

Qwen (Alibaba) · Китай

Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.

  • Расчёты и проверка формул
  • Сложная аналитика с пошаговым разбором
  • Проверка логики договоров и регламентов
Размеры
32B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

s1

Стэнфордский университет · США

Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.

  • Расчёты и проверка формул
  • Разбор сложных задач по шагам
  • Обучение
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Математика и рассужденияGGUF2025

Light-R1

Qihoo 360 · Китай

Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.

  • Расчёты и проверка формул
  • Разбор задач по шагам
  • Основа для своего дообучения рассуждениям
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиGGUF2024–2025

F5-TTS

Шанхайский университет Цзяотун и партнёры · Китай

Модель клонирования голоса по нескольким секундам образца, английский и китайский. Сообщество выпустило много дообученных версий под другие языки, в том числе русский.

  • Клонирование голоса
  • Озвучка аудиокниг и роликов
  • Исследования и прототипы
Размеры
около 340M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Поиск по сканам документов2025

Nomic Embed Multimodal / ColNomic

Nomic AI · США

Поиск по страницам PDF и сканам как по картинкам. В карточках заявлены английский, итальянский, французский, немецкий и испанский — русского в списке нет.

  • Поиск по архиву сканов и PDF
  • Поиск по таблицам и схемам внутри документов
  • Подбор страниц для ответа ИИ-помощника
Размеры
3B и 7B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Математика и рассужденияGGUF2025

Sky-T1

NovaSky (Sky Computing Lab, Беркли) · США

Рассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.

  • Расчёты и проверка формул
  • Разбор задач по шагам
  • Основа для своего дообучения рассуждениям
Размеры
7B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Роботы2024–2025

OpenVLA

Стэнфорд, Беркли и партнёры · США

Первая крупная открытая модель «зрение-язык-действие»: робот-манипулятор выполняет команды вроде «положи яблоко в миску». OFT ускоряет её в разы.

  • Управление манипулятором по текстовой команде
  • Пилоты по роботизации простых операций
  • Основа для дообучения под свой робот
Размеры
7B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ТекстOllama2023–2025

Tulu

Ai2 · США

Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.

  • Ассистент для сотрудников на своём сервере
  • Математика и точное следование инструкциям
  • Образец рецепта для собственного дообучения
Размеры
7B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Агенты для компьютераGGUF2025

Magma

Microsoft Research · США

Модель-агент, которая одинаково планирует действия и в интерфейсе (кнопки на экране), и для робота (движения манипулятора). Пока скорее исследовательская база, чем готовый продукт.

  • Пилоты по управлению интерфейсом
  • Исследовательские проекты на стыке экрана и робототехники
  • Разбор скриншотов с планом действий
Размеры
8B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Медицина2024–2025

Bioptimus H-optimus

Bioptimus · Франция

Базовые модели патологии французской Bioptimus на 1,1B параметров, плюс компактная H0-mini. Первая версия открыта под Apache 2.0. Не заменяет врача, решения принимает специалист.

  • Признаки участков гистологических стекол для исследовательских моделей
  • Прототип сортировки препаратов по типу ткани
  • Научные проекты по связи морфологии и молекулярных данных
Размеры
86M (H0-mini) – 1,1B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Математика и рассужденияOllama2024–2025

Qwen2.5-Math

Qwen (Alibaba) · Китай

Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.

  • Расчёты и проверка формул
  • Проверка расчётов в сметах и отчётах
  • Разбор задач по шагам
Размеры
1.5B – 72B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Медицина2024–2025

MahmoodLab UNI / UNI 2

Mahmood Lab (Mass General Brigham, Гарвард) · США

Базовая модель для гистологических препаратов: превращает участки цифровых стекол в признаки для классификации тканей. Не заменяет врача, решения принимает специалист.

  • Исследовательские классификаторы типов тканей по цифровым стеклам
  • Поиск похожих случаев в архиве препаратов
  • Подготовка признаков для научных моделей прогноза
Размеры
около 300M (UNI) – около 680M (UNI2-h)
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Проверка фактов и оценка ответов2025

Atla Selene

Atla · Великобритания

Модель-судья на 8B: оценивает ответ другой модели по вашим критериям и пишет обоснование. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.

  • Оценка ответов чат-бота по своим критериям
  • Сравнение двух версий подсказки или модели
  • Отбраковка слабых ответов перед отправкой человеку
Размеры
8B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Музыка и звук2024

MuQ / MuQ-MuLan

Tencent AI Lab · Китай

Музыкальный энкодер MuQ и модель MuQ-MuLan, которая сопоставляет музыку и текст: можно искать треки по описанию на английском или китайском.

  • Поиск музыки по текстовому описанию
  • Разметка треков по жанру и настроению
  • Подбор похожей музыки
Размеры
300M – 700M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Медицина2024

MahmoodLab CONCH / TITAN

Mahmood Lab (Mass General Brigham, Гарвард) · США

Модели «картинка + текст» для патологии: поиск препаратов по описанию на английском, классификация без дообучения, TITAN описывает целое стекло. Не заменяет врача, решения принимает специалист.

  • Поиск по архиву стекол по текстовому запросу для исследований
  • Черновые описания препаратов для научных проектов
  • Классификация тканей без разметки на старте исследования
Размеры
около 160M – 300M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Видео2024

CogVideoX

Zhipu AI (Z.ai) и Университет Цинхуа · Китай

Модель видео на 2–5B, которая запускается на одной игровой видеокарте. Популярная база для исследований и надстроек.

  • Короткие ролики из текста
  • Оживление изображений
  • Эксперименты с дообучением видео
Размеры
2B – 5B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Музыка и звук2023–2024

MusicGen (AudioCraft)

Meta · США

Генерация инструментальной музыки по текстовому описанию или по мелодии-образцу. Одна из первых открытых моделей такого рода.

  • Черновые музыкальные наброски
  • Музыка для прототипов роликов
  • Исследования
Размеры
300M – 3.3B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Картинка + текстGGUF2024

PaliGemma

Google · США

Модель зрения Google на базе Gemma, задуманная как основа для дообучения под узкую задачу: подписи, поиск объектов, чтение текста.

  • Дообучение под свою задачу распознавания
  • Поиск объектов на фото
  • Чтение текста на изображениях
Размеры
3B – 28B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllama2024

Athene

Nexusflow · США

Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.

  • Исследование агентов и вызова функций
  • Сравнение с коммерческими моделями
  • Эксперименты с чат-ассистентом
Размеры
70B – 72B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Биология и химия2024

AlphaFold 3

Google DeepMind и Isomorphic Labs · Великобритания

Эталонная модель структуры биомолекул и их комплексов. Веса выдаются только для некоммерческих исследований; компаниям нужен коммерческий доступ через облако Google или открытые аналоги (Boltz, OpenFold3).

  • Академические исследования структуры белков и комплексов
  • Сравнение открытых аналогов с эталоном на своих мишенях
Размеры
один набор весов
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Финансы2023–2024

FinMA (PIXIU)

The Fin AI / ChanceFocus · международный проект

Одно из первых открытых семейств моделей для финансового текста: разбор отчётности, новостей и вопросов по цифрам. Не инвестиционная рекомендация: решения принимает специалист.

  • Разбор финансовой отчётности и пресс-релизов
  • Ответы на вопросы по числовым данным из документов
  • Классификация финансовых текстов
Размеры
0.5B – 30B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Финансы2023–2024

FinGPT

AI4Finance Foundation · США

Открытый набор лёгких надстроек к обычным языковым моделям для работы с финансовыми текстами и новостями. Не инвестиционная рекомендация: решения принимает специалист.

  • Оценка тона финансовых новостей и отчётов
  • Разметка упоминаний компаний и инструментов в тексте
  • Подготовка сводок по потоку деловых новостей
Размеры
адаптеры к базовым моделям 6B – 20B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Поиск по сканам документов2024

VLM2Vec

TIGER-Lab · Канада

Превращает модель «картинка плюс текст» в модель эмбеддингов: один вектор для страницы, схемы или фото с подписью. В карточке заявлен английский язык.

  • Поиск по смешанному архиву текстов и картинок
  • Поиск по страницам документов как по изображениям
  • Подбор похожих карточек и иллюстраций
Размеры
около 4B (на базе Phi-3.5-V)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Поиск по сканам документов2024

DSE (Document Screenshot Embedding)

Университет Ватерлоо, проект Tevatron · Канада

Ищет по скриншотам страниц: страницу не распознают, а превращают целиком в один вектор — индекс компактнее, чем у моделей с поздним взаимодействием. Языки в карточке: английский и французский.

  • Поиск по сканам и PDF без распознавания текста
  • Поиск по презентациям и отчётам со сложной вёрсткой
  • Подбор страниц для ответа ИИ-помощника
Размеры
2B (на базе Qwen2-VL)
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ПереводRUНе развивается2023–2024

ALMA и X-ALMA

Университет Джонса Хопкинса и Microsoft · США

Исследовательские переводчики на основе Llama 2. Первая ALMA знала 5 пар с английским, включая русский; X-ALMA расширила охват до 50 языков.

  • Перевод между английским и русским
  • Эксперименты с переводом на базе языковых моделей
  • Основа для дообучения переводчика
Размеры
7B – 13B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Картинка + текстНе развивается2023–2024

IDEFICS

Hugging Face · Франция / США

Открытые модели зрения от Hugging Face, воспроизводившие закрытую Flamingo. Idefics3 стала основой для компактной линейки SmolVLM.

  • Ответы на вопросы по картинкам
  • Разбор документов и скриншотов
  • Основа для дообучения
Размеры
8B – 80B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
МедицинаНе развивается2024

Paige Virchow

Paige · США

Базовая модель патологии от Paige, обученная на миллионах цифровых стекол. Первая версия под Apache 2.0, вторая только для науки. Не заменяет врача, решения принимает специалист.

  • Признаки участков стекол для исследовательских классификаторов
  • Отбор препаратов для пересмотра в научных проектах
  • Сравнение с другими моделями патологии на своём архиве
Размеры
около 632M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаGGUFНе развивается2023–2024

Med42

M42 Health · ОАЭ

Клинические модели абу-дабийской M42 на основе Llama, настроенные отвечать на медицинские вопросы. Не заменяет врача, решения принимает специалист.

  • Справочные ответы персоналу по клиническим вопросам
  • Черновики выписок и писем для проверки врачом
  • Поиск по медицинской литературе
Размеры
8B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Табличные данныеНе развивается2024

TabuLa-8B

ML Foundations · США

Базовая модель для предсказаний по таблицам: делает классификацию и прогноз по нескольким примерам, без отдельного обучения под задачу.

  • Классификация записей в таблице по нескольким примерам
  • Прогноз значения по строке данных
  • Быстрая проверка гипотез на новых наборах данных
Размеры
8B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

Yi

01.AI · Китай

Двуязычные (английский и китайский) модели 01.AI на 6–34B с версиями на контекст до 200 тыс. токенов. Новых открытых выпусков с 2024 года нет.

  • Чат-ассистент на одной видеокарте
  • Разбор длинных документов
  • Классификация и извлечение данных из текста
Размеры
6B – 34B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Детекция подделокНе развивается2024

MAGE

UC Santa Barbara и соавторы · США

Детектор ИИ-текста на Longformer: держит длинный документ целиком и обучен на текстах от множества разных языковых моделей. Ошибается в обе стороны, его вывод — повод для проверки человеком.

  • Проверка длинных статей и отчётов целиком
  • Отсев машинного текста в потоке публикаций
  • Сравнение детекторов на своих данных
Размеры
около 150M (Longformer-base)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответовНе развивается2024

ArmoRM (RLHFlow)

RLHFlow · США

Оценщик ответов, который выдаёт не один общий балл, а разбор сразу по нескольким признакам. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.

  • Отбор лучшего из нескольких вариантов ответа
  • Подготовка данных для дообучения модели
  • Оценка ответов помощника по нескольким признакам
Размеры
8B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
МедицинаGGUFНе развивается2024

BioMistral

Авиньонский университет и Нантский университет · Франция

Mistral 7B, дообученная на статьях PubMed Central, плюс несколько слияний с общей моделью. Компактная и простая в запуске. Не заменяет врача, решения принимает специалист.

  • Поиск и пересказ медицинских статей
  • Черновики справочных материалов для персонала
  • Разбор медицинской терминологии
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
МедицинаGGUFНе развивается2024

OpenBioLLM

Saama AI Research · Индия

Llama 3, дообученная на медицинских и биологических данных. Одна из первых сильных открытых медицинских моделей 2024 года. Не заменяет врача, решения принимает специалист.

  • Извлечение данных из медицинских документов
  • Черновики выписок для проверки врачом
  • Поиск по медицинской литературе
Размеры
8B, 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстOllamaНе развивается2023–2024

Zephyr

Hugging Face (H4) · США

Учебные чат-модели Hugging Face на базе Mistral, Gemma и Mixtral с открытым рецептом дообучения. Zephyr 7B Beta показал, что маленькую модель можно «воспитать» до уровня крупных без ручной разметки людьми.

  • Лёгкий чат-ассистент
  • Образец и отправная точка для своего дообучения
  • Черновики текстов и ответов
Размеры
7B – 141B-A35B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одеждыНе развивается2024

IDM-VTON

KAIST и OMNIOUS.AI · Южная Корея

Одна из самых известных открытых примерок: переносит вещь с фото товара на фото человека, хорошо держит принты и логотипы. Лицензия некоммерческая.

  • Пилот примерочной на сайте магазина
  • Прототип карточек товара на модели без фотосессии
  • Сравнение с коммерческими сервисами примерки
Размеры
на базе SDXL
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Разбор текстаНе развивается2024

OccCANINE

University of Southern Denmark · Дания

Переводит свободное описание профессии в стандартный код HISCO на 13 языках. Создана для исторических архивов, но годится и для наведения порядка в справочниках должностей. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.

  • Приведение разнородных названий профессий к единому коду
  • Разбор архивов кадровых и статистических данных
  • Подготовка данных для отчётности
Размеры
на базе CANINE-s, размер на карточке не указан
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одеждыНе развивается2024

OOTDiffusion

Xiao-i Research · Китай

Ранняя популярная открытая примерка: одна версия для верхней одежды по пояс, другая для образа в полный рост. Лицензия некоммерческая.

  • Примерка верха на фото модели
  • Примерка в полный рост: верх, низ, платья
  • Прототип примерочной для тестов
Размеры
на базе Stable Diffusion
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
ТекстOllamaНе развивается2023–2024

TinyLlama

TinyLlama (исследователи SUTD) · Сингапур

Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.

  • Простые чат-боты на слабом железе
  • Эксперименты и обучение команды
  • Основа для дообучения под узкую задачу
Размеры
1.1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Детекция подделокНе развивается2023–2024

IML-ViT

Sichuan University и соавторы · Китай

Открытая модель поиска подделок в изображениях: выдаёт попиксельную маску изменённых участков. Ошибается в обе стороны, её карта — подсказка эксперту, а не доказательство подделки.

  • Поиск вклеенных и затёртых фрагментов на фото
  • Проверка сканов документов на правку
  • Базовая линия при сравнении моделей поиска монтажа
Размеры
модель на базе Vision Transformer
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
ПрогнозыНе развивается2024

Lag-Llama

ServiceNow, Mila и партнёры · Канада

Одна из первых открытых моделей прогнозов «из коробки». Крошечная, даёт вероятностный прогноз, сейчас уступает Chronos и TimesFM.

  • Вероятностный прогноз продаж
  • Быстрые пилоты прогнозирования
  • Базовая модель для сравнения
Размеры
2.4M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Примерка одеждыНе развивается2024

StableVITON

KAIST · Южная Корея

Исследовательская модель примерки с конференции CVPR 2024, одна из первых на базе Stable Diffusion. Сейчас чаще служит точкой сравнения.

  • Пилот примерки верхней одежды
  • Сравнение качества разных моделей примерки
  • Обучение своей примерки на базе открытого кода
Размеры
на базе Stable Diffusion
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
Обработка фотоНе развивается2024

SUPIR

XPixel Group (Шэньчжэньский институт передовых технологий АН Китая, Shanghai AI Lab и др.) · Китай

Мощное восстановление сильно испорченных фото на базе SDXL: дорисовывает детали, а не просто увеличивает. Требовательна к железу, лицензия некоммерческая.

  • Восстановление старых и размытых фото
  • Увеличение снимков с дорисовкой деталей
  • Пилоты реставрации архивов
Размеры
на базе SDXL, плюс LLaVA 13B для описаний
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
ТекстOllamaНе развивается2023–2024

WizardLM, WizardCoder, WizardMath

WizardLM (Microsoft и Пекинский университет) · США / Китай

Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.

  • Сложные многошаговые инструкции
  • Помощь программистам
  • Решение математических задач
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Спутниковые снимки и геоНе развивается2023–2024

Ai2 SatlasPretrain

Allen Institute for AI (Ai2) · США

Предобученные модели проекта Satlas для снимков Sentinel-2, Landsat и аэрофото высокого разрешения. Предшественник OlmoEarth, до сих пор используется в TorchGeo.

  • Поиск объектов на снимках: солнечные станции, ветряки, суда
  • Разметка дорог и застройки по аэрофото
  • Стартовая точка для дообучения своей геомодели
Размеры
Swin-v2 и ResNet бэкбоны (Base)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
РеранкерыGGUFНе развивается2023–2024

RankVicuna / RankLLaMA / RankZephyr (Castorini)

Университет Ватерлоо, группа Castorini · Канада

Реранкеры-языковые модели: получают сразу список найденных фрагментов и переставляют его целиком, а не оценивают фрагменты по одному. Тяжелее обычных реранкеров.

  • Переупорядочивание длинной выдачи поиска
  • Отбор источников для ответа ИИ-помощника
  • Исследовательские сравнения способов поиска
Размеры
7B – 13B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Голосовые ассистентыRUНе развивается2023

SeamlessM4T / Seamless

Meta · США

Перевод речи и текста примерно между сотней языков, включая русский: речь в текст, речь в речь, потоковый перевод с сохранением интонации.

  • Перевод речи в речь
  • Перевод и расшифровка записей
  • Потоковый перевод
Размеры
281M – 2.3B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ТекстOllamaНе развивается2023

Orca 2

Microsoft Research · США

Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.

  • Исследования методов рассуждения
  • Сравнение с современными малыми моделями
  • Обучение специалистов
Размеры
7B – 13B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Табличные данныеНе развивается2023

TableLlama

OSU NLP Group, Университет штата Огайо · США

Универсальная модель по таблицам: заполнение пропусков, поиск строк, сопоставление колонок и ответы на вопросы по данным.

  • Ответы на вопросы по таблицам из документов
  • Сопоставление колонок разных таблиц
  • Поиск и дополнение записей в справочниках
Размеры
7B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Синтез речиRUНе развивается2023

Coqui XTTS

Coqui · Германия

Популярная модель клонирования голоса по короткому образцу на 17 языках, включая русский. Компания Coqui закрылась, развитие остановлено.

  • Клонирование голоса по образцу
  • Озвучка на нескольких языках
  • Исследования и прототипы
Размеры
около 470M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Документы и OCRНе развивается2023

Nougat

Meta · США

Ранняя модель, переводящая научные PDF в текст с формулами. Сегодня устарела, её обходят почти все современные OCR-модели.

  • Перевод научных статей из PDF в текст с формулами
  • Оцифровка технической документации
Размеры
250M – 350M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
МедицинаНе развивается2023

Clinical Camel

Лаборатория Бо Ванга (Университет Торонто, Vector Institute) · Канада

Ранняя медицинская модель на Llama 2 70B, обученная на диалогах по медицинским текстам. Сейчас интересна в основном для исследований. Не заменяет врача, решения принимает специалист.

  • Исследовательские пилоты по медицинским диалогам
  • Учебные материалы для персонала
  • Сравнение с новыми медицинскими моделями
Размеры
70B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
МедицинаНе развивается2023

RadFM

Шанхайский университет Цзяо Тун и Shanghai AI Lab · Китай

Ранняя общая модель для радиологии: понимает 2D- и 3D-снимки (КТ, МРТ) вместе с текстом. Скорее исследовательская база. Не заменяет врача, решения принимает специалист.

  • Исследовательские пилоты по разбору КТ и МРТ
  • Подсказки при разборе снимков для врача
  • Основа для своего дообучения на снимках клиники
Размеры
размер на карточке не указан
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
ТекстRUGGUFНе развивается2022–2023

mGPT

Сбер (ai-forever) · Россия

Многоязычная модель Сбера на 61 язык, включая языки народов России и СНГ. Есть отдельные доучки под бурятский, якутский, татарский, башкирский, казахский и другие языки — редкость для открытых моделей.

  • Тексты на языках народов России и СНГ
  • Основа для дообучения под редкий язык
  • Черновики и шаблоны на нескольких языках
Размеры
1.3B – 13B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстOllamaНе развивается2023

Vicuna

LMSYS (Беркли и партнёры) · США

Одна из первых открытых чат-моделей 2023 года: LLaMA, дообученная на диалогах пользователей ChatGPT. Историческая веха, сегодня уступает любой современной модели того же размера.

  • Эксперименты и обучение команды
  • Простой чат-ассистент для тестов
  • Сравнение с новыми моделями
Размеры
7B – 33B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КибербезопасностьНе развивается2022–2023

SecureBERT

Ehsan Aghaei и соавторы · США

Компактный языковой энкодер, обученный на текстах по кибербезопасности: разметка отчётов об угрозах, поиск сущностей и классификация.

  • Разметка отчётов об угрозах и бюллетеней по уязвимостям
  • Извлечение сущностей из текстов по безопасности
  • Классификация и поиск по внутренней базе инцидентов
Размеры
около 125M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Погода и климатНе развивается2023

Huawei Pangu-Weather

Huawei Cloud · Китай

Одна из первых погодных нейросетей, опубликованная в Nature и подключённая к графикам ECMWF. Веса открыты только для исследований, коммерция запрещена.

  • Исследовательские прогнозы погоды на неделю вперёд
  • Сравнение с другими погодными моделями на своих данных
  • Учебные курсы по погодным нейросетям
Размеры
4 модели по ~1,1 ГБ (шаг 1, 3, 6 и 24 часа)
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Обработка фотоНе развивается2023

StableSR

S-Lab, Наньянский технологический университет · Сингапур

Одна из первых моделей увеличения фото на базе Stable Diffusion: восстанавливает реалистичные детали. Лицензия некоммерческая.

  • Увеличение фото с дорисовкой деталей
  • Исследовательские пилоты реставрации
  • Сравнение с классическими апскейлерами
Размеры
на базе SD 2.1
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
КартинкиНе развивается2023

DeepFloyd IF

DeepFloyd (Stability AI) · Великобритания

Ранняя модель, которая одной из первых научилась аккуратно писать текст на картинках. Сейчас интересна скорее как история, развитие остановлено.

  • Исследовательские эксперименты
  • Прототипы картинок с надписями
Размеры
0.4B – 4.3B
Железо
от: 1 видеокарта
Только некоммерческоеПодробнее
ТекстНе развивается2022–2023

Pythia и GPT-NeoX

EleutherAI · США

Полностью открытые модели некоммерческой лаборатории EleutherAI: GPT-NeoX-20B и серия Pythia с опубликованными промежуточными снимками обучения.

  • Базовая модель для дообучения
  • Исследование поведения моделей
  • Простая генерация и дополнение текста
Размеры
70M – 20B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстНе развивается2022

OPT

Meta · США

Ранняя открытая серия Meta, повторяющая по размерам GPT-3. Устарела, полезна для исследований и сравнения.

  • Исследовательские эксперименты
  • Обучение специалистов
  • Сравнение с современными моделями
Размеры
125M – 66B (175B по запросу)
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ТекстGGUFНе развивается2022

BLOOM

BigScience (Hugging Face и сообщество) · Франция

Одна из первых больших открытых моделей, обученная сообществом из сотен исследователей на 46 языках. Сегодня интересна скорее как историческая веха.

  • Генерация и перевод текстов на многих языках
  • Эксперименты и обучение команды
  • Базовая модель для дообучения под узкую задачу
Размеры
560M – 176B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение