МедицинаGGUF2023–2026
FreedomIntelligence (Китайский университет Гонконга, Шэньчжэнь) · Китай
Большое семейство медицинских моделей: чат, версия со снимками, рассуждающая HuatuoGPT-o1 и новая HuatuoGPT-3 на Qwen3. Не заменяет врача, решения принимает специалист.
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Подсказки при разборе снимков для врача (Vision)
- Размеры
- 7B – 72B
- Железо
- от: Ноутбук
ТекстOllama2023–2026
Shanghai AI Laboratory · Китай
Модели Шанхайской лаборатории ИИ. Ранняя линия InternLM — универсальная, новая Intern-S1/S2 — научная: понимает формулы, молекулы, графики и картинки.
- Помощник исследователя: статьи, формулы, данные
- Разбор научных и технических документов
- Корпоративный чат на малых моделях
- Размеры
- 1.8B – около 1T
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Xiaomi · Китай
Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.
- Логические и расчётные задачи
- Агенты с инструментами
- Помощь программистам
- Размеры
- 7B – 1,02T-A42B
- Железо
- от: Ноутбук
Текст2024–2026
MBZUAI, Институт фундаментальных моделей (IFM, проект LLM360) · ОАЭ
Полностью открытые модели из ОАЭ: вместе с весами опубликованы данные, код обучения и промежуточные чекпоинты. K2-Horizon 2026 года — линейка от 0.9B до 375B с контекстом до 512 тыс. токенов.
- Рассуждения, математика и технические вопросы
- Разбор длинных документов
- Агенты и написание кода
- Размеры
- 0.9B – 375B-A23B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Жэньминьский университет (GSAI) и Ant Group (inclusionAI) · Китай
Диффузионные языковые модели: текст пишется не по одному слову, а сразу блоками с последующим уточнением, что ускоряет генерацию. LLaDA2.2 умеет править уже написанное и рассчитана на агентов. Генератор картинок LLaDA-Image — отдельный продукт.
- Быстрая генерация кода и текстов
- Агентные сценарии с длинным контекстом
- Исследования альтернатив обычным LLM
- Размеры
- 8B – 100B (MoE)
- Железо
- от: 1 видеокарта
3D2024–2026
NAVER LABS Europe · Франция (NAVER, Южная Корея)
Семейство, с которого началась 3D-реконструкция «в один проход» по паре или набору фото без калибровки камер. MASt3R добавил сопоставление точек и масштаб, MUSt3R и BLASt3R — работу с видео.
- 3D-сцена по нескольким фото без калибровки
- Сопоставление точек между снимками
- Построение карты по видео (SLAM)
- Размеры
- 0.57B – 0.69B
- Железо
- от: Ноутбук
Музыка и звукGGUF2022–2026
m-a-p (Multimodal Art Projection) · Великобритания / Китай
Энкодер музыки: превращает трек в числовое описание, по которому определяют жанр, настроение, тональность и ритм. MERT-v2 работает с целыми песнями до 6 минут.
- Автоматическая разметка музыкального каталога
- Поиск похожих треков
- Определение жанра, настроения и темпа
- Размеры
- 95M – 632M
- Железо
- от: Ноутбук
Автономное вождение2020–2026
comma.ai · США
Открытая система помощи водителю: нейросеть по камере держит полосу и управляет скоростью, плюс модель контроля внимания водителя. Модели лежат прямо в репозитории и обновляются постоянно.
- Исследовательский стенд систем помощи водителю
- Изучение контроля внимания водителя по камере в салоне
- Сравнение со своими алгоритмами удержания полосы
- Размеры
- компактная, рассчитана на бортовое устройство
- Железо
- от: Ноутбук
ТекстRU2026
SberDevices (ai-forever) · Россия
Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.
- Эксперименты с ускорением генерации
- Дообучение небольших моделей под свои задачи
- Исследования
- Размеры
- 0.6B – 4B
- Железо
- от: Ноутбук
Документы и OCR2026
Jina AI · Германия
Разбор документов одной моделью: страница целиком превращается в Markdown — текст в правильном порядке чтения, таблицы и формулы в LaTeX. Построена на DeepSeek-OCR, активны только 0,6 млрд параметров из 3,4.
- Перевод сканов и PDF в Markdown
- Распознавание таблиц и формул
- Разбор счетов, актов и отчётов
- Размеры
- 3.4B-A0.6B
- Железо
- от: 1 видеокарта
Голосовые ассистенты2026
Samsung · Южная Корея
Крошечные модели понимания звука для смартфона: слушают речь, музыку и звуки вокруг и отвечают текстом — описывают запись и отвечают на вопросы о ней. Работают прямо на устройстве, вопросы и ответы — на английском: других языков в обучающих данных нет.
- Описание аудиозаписи словами
- Ответы на вопросы о звуке
- Определение типа звука и обстановки
- Размеры
- 99M – 356M
- Железо
- от: Ноутбук
Компьютерное зрение2024–2026
Microsoft Research · США
Восстанавливает 3D-геометрию сцены по одной фотографии: глубину в метрах, облако точек и нормали поверхностей.
- Замеры помещений и объектов по фото
- 3D-облако точек из снимка
- Подготовка данных для роботов и AR
- Размеры
- ViT-S – ViT-G
- Железо
- от: Ноутбук
Роботы2025–2026
GigaAI · Китай
Модель управления роботами, обученная в основном на синтетических данных из модели мира. Позволяет меньше тратить на сбор данных с реальных роботов.
- Управление манипулятором
- Дообучение на малом объёме своих данных
- Пилоты сортировки и сборки
- Размеры
- 3.5B
- Железо
- от: 1 видеокарта
ТекстOllama2024–2026
NVIDIA · США
Модели NVIDIA для агентов и рассуждений, заточенные под быстрый запуск на её видеокартах. Nemotron 3 это гибрид Mamba и MoE от 4B до 550B; Nano Omni разбирает видео, аудио и картинки (только английский).
- Агенты с вызовом инструментов
- Задачи с рассуждением и расчётами
- Ответы по длинным документам
- Размеры
- 4B – 550B-A55B
- Железо
- от: Ноутбук
Погода и климат2024–2026
Allen Institute for AI (Ai2) · США
Быстрый эмулятор климатической модели: моделирует атмосферу на годы и десятилетия вперёд на одной видеокарте. Есть связка с океаном (SamudrACE) для долгосрочных сценариев.
- Сценарии климата на десятилетия для оценки долгосрочных рисков активов
- Массовые расчёты «что если» по температуре и осадкам
- Подготовка данных для моделей урожайности и спроса на энергию
- Размеры
- чекпоинт около 1,8 ГБ
- Железо
- от: 1 видеокарта
Погода и климат2023–2026
Google DeepMind · Великобритания
Семейство глобальных погодных моделей Google DeepMind: GraphCast (прогноз на 10 дней), GenCast (ансамбль вероятностей) и WeatherNext 2 с прогнозом циклонов. С августа 2026 веса разрешены для коммерции.
- Среднесрочный прогноз погоды для планирования смен, рейсов и поставок
- Вероятностная оценка экстремальной погоды для страховых портфелей
- Прогноз траекторий тропических циклонов для морских и портовых операций
- Размеры
- от облегчённых версий 1° до полных 0,25°
- Железо
- от: 1 видеокарта
Биология и химия2022–2026
Лаборатория AlQuraishi (Колумбийский университет) и консорциум OpenFold · США
Полностью открытое воспроизведение AlphaFold 2, а затем AlphaFold 3 под Apache 2.0 с обучающими данными. OpenFold3 предсказывает комплексы белков, нуклеиновых кислот и лигандов.
- Предсказание структуры белков и комплексов с лигандами
- Дообучение на собственных данных компании (код обучения открыт)
- Внутренний сервис структурного анализа без передачи данных наружу
- Размеры
- один набор весов на версию
- Железо
- от: 1 видеокарта
Автономное вождение2025–2026
NVIDIA · США
Модели «зрение–язык–действие» для беспилотников: по видео с камер строят траекторию и объясняют решение текстом. Используются для разработки и проверки систем автопилота, а не как готовый автопилот.
- Авторазметка записей с камер для обучения своих систем помощи водителю
- Разбор сложных дорожных сцен с текстовым объяснением
- Проверка систем автопилота в симуляторе на редких сценариях
- Размеры
- 10B – 34B
- Железо
- от: 1 видеокарта
Автономное вождение2026
Alibaba (команда Qwen) · Китай
Модель для автономного вождения на базе Qwen3.5-4B: 3D-распознавание объектов вокруг машины, ответы на вопросы о дорожной сцене и планирование траектории в одной модели.
- Прототип восприятия и планирования для беспилотной техники на закрытой территории
- Ответы на вопросы о записях с камер при разборе инцидентов
- Разметка дорожных сцен для обучения своих моделей
- Размеры
- 4B
- Железо
- от: 1 видеокарта
Детекция подделок2023–2026
University of Wisconsin-Madison · США
Ранний и до сих пор используемый подход: поверх замороженного CLIP обучается простой классификатор, который переносится на незнакомые генераторы. Ошибается в обе стороны — вывод требует проверки человеком.
- Проверка изображений от новых, незнакомых генераторов
- Базовая линия при сравнении детекторов
- Быстрое внедрение проверки без дообучения крупной модели
- Размеры
- линейный классификатор поверх CLIP ViT-L/14
- Железо
- от: Ноутбук
Роботы2025–2026
NVIDIA · США
Модели «мира» для роботов и беспилотников: генерируют реалистичное видео физических сцен и предсказывают действия. Cosmos 3 объединяет понимание, генерацию и управление.
- Синтетические видео для обучения роботов и беспилотников
- Проверка сценариев в симуляции
- Управление роботом (Policy-версии)
- Размеры
- 2B – 65B
- Железо
- от: 1 видеокарта
Роботы2026
Ant Group (Robbyant) · Китай
Модель управления роботами от Ant Group, обученная на большом объёме данных с реальных роботов. Версия 2.0 работает с разными типами манипуляторов.
- Управление двуруким манипулятором
- Дообучение под свою операцию
- Пилоты сборки и сортировки
- Размеры
- 4B – 6B
- Железо
- от: 1 видеокарта
Роботы2026
Xiaomi · Китай
Открытые модели управления роботами от Xiaomi. Robotics-1 рассчитана на бытовые и кухонные задачи, U0 объединяет понимание сцены и действия.
- Управление манипулятором по команде
- Бытовые и сервисные сценарии
- Основа для дообучения
- Размеры
- 4B – 5B
- Железо
- от: 1 видеокарта
ТекстGGUF2025–2026
Moonshot AI · Китай
Сверхкрупные MoE-модели Moonshot для агентной работы. K3 на 2,8 трлн параметров — самая большая открытая модель на момент выхода, с контекстом до 1 млн токенов и пониманием картинок; K2.7-Code заточена под программирование.
- Многошаговые агенты: поиск, сбор данных, отчёты
- Глубокий анализ документов
- Помощь программистам
- Размеры
- 16B-A3B – 2.8T-A104B
- Железо
- от: 1 видеокарта
ТекстOllama2024–2026
LG AI Research · Южная Корея
Корейско-английские модели LG. Большая часть линии некоммерческая, но флагман K-EXAONE 2.0 на 750 млрд параметров вышел под Apache 2.0.
- Корпоративный ассистент
- Работа с корейскими и английскими текстами
- Разбор документов и картинок (4.5)
- Размеры
- 1.2B – 750B-A37B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Swiss AI (ETH Zurich, EPFL, CSCS) · Швейцария
Государственная открытая модель Швейцарии: открыты веса, данные и рецепт, более 1000 языков в обучении. Версия 1.5 понимает изображения.
- Многоязычный ассистент
- Ответы по документам
- Разбор изображений и сканов (v1.5)
- Размеры
- 0.5B – 70B
- Железо
- от: Ноутбук
Картинка + текстGGUF2024–2026
Alibaba (AIDC-AI) · Китай
Модели зрения от международного подразделения Alibaba с сильным чтением текста и таблиц. В линейке есть MoE Ovis2.6 и отдельные компактные OvisOCR для документов.
- Извлечение данных из счетов, договоров и накладных
- Распознавание таблиц
- Ответы на вопросы по фото и графикам
- Размеры
- 0.9B – 80B-A3B
- Железо
- от: Ноутбук
Табличные данные2026
LG AI Research · Южная Корея
Маленькая табличная модель LG: при 21M параметров почти догоняет лидеров по точности классификации и регрессии. Веса только для некоммерческого использования.
- Пилотные прогнозы оттока
- Проверка гипотез по скорингу
- Исследование клиентских данных
- Размеры
- около 21M
- Железо
- от: Ноутбук
Погода и климат2024–2026
Microsoft Research · США
Базовая модель атмосферы Земли: глобальный прогноз погоды, отдельные версии для качества воздуха и морских волн. Считает прогноз за секунды вместо часов на суперкомпьютере.
- Собственный прогноз температуры, ветра и осадков по точкам присутствия компании
- Оценка волнения моря для планирования рейсов и портовых работ
- Прогноз загрязнения воздуха для промышленных площадок
- Размеры
- около 1,3B (есть малая версия для тестов)
- Железо
- от: 1 видеокарта
Погода и климат2022–2026
NVIDIA · США
Набор погодных и климатических моделей NVIDIA: глобальный прогноз FourCastNet, детализация до километров (CorrDiff), прогноз гроз по региону (StormCast), генерация климата (cBottle, Atlas). Запускаются через Earth2Studio.
- Глобальный прогноз с последующей детализацией на нужный регион
- Краткосрочный прогноз гроз и сильных осадков для диспетчерских служб
- Генерация множества погодных сценариев для стресс-тестов
- Размеры
- 98M – 2,5B (FourCastNet 3 — около 711M)
- Железо
- от: 1 видеокарта
КартинкиGGUF2026
Ideogram · Канада
Открытые веса модели Ideogram, известной точной типографикой. Под некоммерческой лицензией: для бизнеса подходит только для тестов.
- Тестирование генерации с текстом
- Исследования и прототипы
- Размеры
- около 9B
- Железо
- от: 1 видеокарта
Математика и рассужденияOllama2025–2026
Open Thoughts (Стэнфорд, Беркли и другие университеты) · США
Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики регламентов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Табличные данные2026
Google Research · США
Крупная табличная модель Google: классификация и регрессия по примерам без обучения, с числовыми и категориальными столбцами. Веса только для некоммерческого использования.
- Пилотное сравнение с текущими моделями скоринга
- Исследование данных о клиентах
- Проверка гипотез по оттоку
- Размеры
- около 1.6B
- Железо
- от: 1 видеокарта
Картинка + текст2023–2026
Shanghai AI Lab (OpenGVLab) · Китай
Семейство моделей для видео: энкодеры для поиска и классификации роликов и чат-модели, которые разбирают длинные видео. InternVideo 3 рассчитан на многочасовые записи.
- Поиск по видеоархиву текстовым запросом
- Распознавание действий на видео
- Ответы на вопросы по длинной записи
- Размеры
- малые энкодеры – 9B
- Железо
- от: Ноутбук
Спутниковые снимки и гео2025–2026
Allen Institute for AI (Ai2) · США
Семейство моделей для снимков Sentinel-1, Sentinel-2 и Landsat от Ai2, с готовыми дообучениями под мангры, вырубки и типы экосистем. Лицензия исключает добывающую отрасль.
- Мониторинг вырубок и состояния лесов в цепочке поставок
- Классификация угодий и культур по серии снимков
- Эмбеддинги снимков для поиска похожих участков
- Размеры
- Nano – Large (Base около 114M)
- Железо
- от: Ноутбук
МедицинаOllama2023–2026
EPFL · Швейцария
Открытые медицинские модели швейцарского EPFL, которые дообучают поверх разных базовых моделей по клиническим руководствам. Не заменяет врача, решения принимает специалист.
- Ответы персоналу по клиническим руководствам
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 2B – 70B
- Железо
- от: Ноутбук
Роботы2025–2026
Ai2 (Allen Institute for AI) · США
Полностью открытая модель управления роботом, которая сначала «рассуждает» о пространстве и траектории, а потом действует. Ход рассуждений можно проверить.
- Управление манипулятором с объяснимыми шагами
- Дообучение под свой робот
- Исследовательские пилоты
- Размеры
- 5B – 8B
- Железо
- от: 1 видеокарта
Картинка + текстOllama2023–2026
LLaVA / LMMs-Lab (исследователи из США и Китая) · США / Китай
Открытый проект, с которого пошла мода на модели «картинка + текст». Линейка OneVision понимает фото, документы и видео; открыты данные и рецепты обучения.
- Ответы на вопросы по фото и скриншотам
- Описание товаров по фотографии
- Разбор видео по кадрам
- Размеры
- 0.5B – 72B
- Железо
- от: Ноутбук
Документы и OCRGGUF2025–2026
Shanghai AI Laboratory (OpenDataLab) · Китай
Популярный открытый инструмент перевода PDF в Markdown со своей небольшой моделью. MinerU2.5-Pro улучшили только за счёт данных, без роста размера. Языки в карточке — китайский и английский.
- Перевод PDF-отчётов и договоров в Markdown
- Распознавание таблиц и формул
- Подготовка документов для RAG и поиска
- Размеры
- 0.9B – 1.2B
- Железо
- от: Ноутбук
3D2025–2026
Meta и Оксфордский университет (VGG) · США / Великобритания
Восстанавливает 3D-сцену по одной, нескольким или сотням фотографий за секунды: положение камер, глубину и облако точек. Лучшая статья CVPR 2025.
- 3D-модель помещения или объекта по серии фото
- Определение положения камер для фотограмметрии
- Облако точек для обмеров и сравнения с планом
- Размеры
- около 1.2B
- Железо
- от: 1 видеокарта
Биология и химия2022–2026
EvolutionaryScale / Chan Zuckerberg Biohub (ESM-2 — Meta AI) · США
Языковые модели белков: понимают аминокислотные последовательности, предсказывают структуру (ESMFold2) и помогают в дизайне белков. С 2026 года все открытые версии под MIT.
- Эмбеддинги белков для предсказания свойств (стабильность, растворимость)
- Предсказание 3D-структуры белков и комплексов
- Отбор кандидатов в дизайне ферментов и антител перед лабораторией
- Размеры
- 8M – 15B (ESM-2), 300M – 6B (ESM C), 1,4B (открытая ESM3)
- Железо
- от: Ноутбук
КодOllama2025–2026
Essential AI · США
Модель на 8B, обученная с нуля компанией одного из авторов архитектуры трансформер. Сильна в коде и технических задачах, версия 1.5 держит контекст до 160 тыс. токенов.
- Генерация и исправление кода
- Агент-разработчик на одной видеокарте
- Решение технических и научных задач
- Размеры
- 8B
- Железо
- от: Ноутбук
Голосовые ассистенты2024–2026
NVIDIA · США
Модели, которые слушают речь, звуки и музыку и отвечают на вопросы о них. Audio Flamingo Next разбирает записи до 30 минут. Только для исследований.
- Подробное описание аудиозаписей
- Вопросы и ответы по длинной записи
- Разметка музыки и звуков
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовRU2025–2026
SberDevices (ai-forever) · Россия
Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.
- Автоматическая проверка качества ответов чат-бота на русском
- Сравнение нескольких моделей перед выбором
- Контроль ответов после дообучения
- Размеры
- 4B – 32B
- Железо
- от: Ноутбук
МедицинаGGUF2025–2026
Чжэцзянский университет · Китай
Медицинская модель для текста, снимков, 3D-исследований и видео: от лёгкой 4B до крупной MoE. Не заменяет врача, решения принимает специалист.
- Подсказки при разборе снимков и КТ для врача
- Черновики заключений и выписок
- Поиск по медицинской литературе
- Размеры
- 4B – 235B-A22B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025–2026
Принстонский университет · США
Открытые модели для формальных доказательств в Lean 4 из Принстона. Свежая Goedel-Code-Prover доказывает корректность программ.
- Формальная проверка математических выкладок
- Проверка корректности кода
- Обучение
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Роботы2025–2026
NVIDIA · США
Базовая модель NVIDIA для человекоподобных роботов и манипуляторов: видит, понимает команду и выдаёт движения. Встроена в экосистему Isaac.
- Управление человекоподобными роботами
- Дообучение под свою роботизированную ячейку
- Обучение в симуляции с переносом на реального робота
- Размеры
- 2B – 3B
- Железо
- от: 1 видеокарта
Синтез речиRU2024–2026
Fish Audio · США / Китай
Синтез речи с клонированием голоса и управлением эмоциями на 80+ языках, включая русский. Качество близко к платным сервисам, но веса только для исследований.
- Клонирование голоса
- Эмоциональная озвучка
- Озвучка на многих языках
- Размеры
- 0.5B – около 4.5B
- Железо
- от: Ноутбук
Картинка + текстGGUF2023–2026
Shanghai AI Laboratory (OpenGVLab) · Китай
Большая линейка китайских моделей зрения с размерами от 1B до 241B. InternVL-U (4B) объединяет понимание картинок, их генерацию и редактирование.
- Понимание документов, схем и графиков
- Ответы на вопросы по фото
- Разбор видео
- Размеры
- 1B – 241B-A28B
- Железо
- от: Ноутбук
Картинка + текст2024–2026
Ai2 (Allen Institute for AI) · США
Полностью открытые модели зрения Ai2 (веса и данные). Умеют указывать точку на картинке и считать предметы; Molmo2 понимает видео, MolmoWeb управляет браузером.
- Подсчёт товаров и объектов на фото
- Указание, где на снимке нужный предмет
- Разбор видео
- Размеры
- 1B-A7B – 72B
- Железо
- от: Ноутбук
Синтез речиRU2026
k2-fsa (Next-gen Kaldi) · Китай
Синтез речи с клонированием голоса по короткому образцу на 646 языках, включая русский и языки народов России. Можно описать голос словами. Веса только для некоммерческого использования.
- Озвучка на редких языках
- Клонирование голоса по образцу
- Исследования и прототипы многоязычной озвучки
- Размеры
- 0.6B
- Железо
- от: Ноутбук
Видео2025–2026
Skywork AI (Kunlun) · Китай
Интерактивная «модель мира»: генерирует видео игрового мира в реальном времени и реагирует на нажатия клавиш и мышь. Версия 3.0 держит память о сцене минутами.
- Прототипы игровых миров без движка
- Интерактивные демо и симуляции
- Генерация данных для обучения агентов
- Размеры
- 1.8B – 17B
- Железо
- от: 1 видеокарта
Табличные данные2025–2026
Lexsi Labs · Индия
Свежие открытые модели для табличных данных: предсказывают по нескольким примерам прямо в запросе, без обучения под конкретную задачу.
- Классификация и прогноз по таблицам без отдельного обучения
- Быстрая проверка моделей на новых наборах данных
- Оценка признаков в больших таблицах
- Размеры
- размер не указан в карточке
- Железо
- от: Ноутбук
Код2026
Ai2 (Allen Institute for AI) · США
Полностью открытые агенты-разработчики от Ai2: открыты веса, данные и рецепт обучения. Задуманы так, чтобы компания могла дешево доучить агента на своём репозитории.
- Агент для исправления задач в коде
- Дообучение агента под внутренний репозиторий
- Автоматизация мелких правок и тестов
- Размеры
- 8B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2026
LM Provers (CMU, Hugging Face, ETH Zurich, Project Numina) · США, Швейцария, Франция
Маленькая модель 4B на Qwen3, которая пишет математические доказательства на обычном языке почти на уровне больших моделей. Запускается на ноутбуке.
- Проверка логики рассуждений и выкладок
- Пошаговое объяснение решений
- Обучение и олимпиадная подготовка
- Размеры
- 4B
- Железо
- от: Ноутбук
Биология и химия2024–2026
Arc Institute (с Together AI, Stanford, NVIDIA) · США
Языковые модели ДНК с контекстом до миллиона нуклеотидов: оценивают влияние мутаций, аннотируют геномы и генерируют последовательности. Evo 2 обучена на геномах всех царств жизни.
- Оценка вероятной вредности генетических вариантов для исследований
- Аннотация геномов микроорганизмов и растений
- Поиск перспективных последовательностей в селекции и синтетической биологии
- Размеры
- 1B – 40B
- Железо
- от: 1 видеокарта
МедицинаOllama2025–2026
Google · США
Медицинская версия Gemma от Google: читает медицинские тексты и снимки (рентген, дерматология, гистология). Инструмент для врача и разработчика, не заменяет врача, решения принимает специалист.
- Черновики выписок и заключений для проверки врачом
- Подсказки при разборе снимков для врача
- Поиск и пересказ медицинской литературы
- Размеры
- 4B – 27B
- Железо
- от: Ноутбук
Медицина2023–2026
Stanford AIMI · США
Стэнфордские модели для рентгена грудной клетки: описывают снимок и готовят черновик заключения. Не заменяет врача, решения принимает специалист.
- Черновик описания рентгенограммы для врача-рентгенолога
- Подсказки при разборе снимков для врача
- Проверка полноты заключений
- Размеры
- 3B – 8B
- Железо
- от: Ноутбук
МедицинаGGUF2025–2026
Alibaba DAMO Academy · Китай
Медицинская модель Alibaba на основе Qwen2.5-VL: понимает снимки разных типов и медицинский текст, умеет рассуждать по шагам. Не заменяет врача, решения принимает специалист.
- Подсказки при разборе снимков для врача
- Черновики заключений и выписок
- Поиск по медицинской литературе
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
МедицинаGGUF2025–2026
Ant Healthcare (Ant Group) и Центр медицинской информации провинции Чжэцзян · Китай
Крупная медицинская MoE-модель на базе Ling-flash-2.0: 100B параметров, из них в работе 6B, поэтому отвечает быстро. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу по клиническим вопросам
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 100B-A6B
- Железо
- от: 1 видеокарта
ТекстOllama2024–2026
Allen Institute for AI (Ai2) · США
Полностью открытые модели: опубликованы не только веса, но и данные, код обучения и промежуточные снимки. Удобно, когда важна прозрачность происхождения.
- Ассистент и ответы по документам
- Задачи с рассуждением (версии Think)
- Дообучение под свои данные с понятной историей модели
- Размеры
- 1B – 32B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
Prime Intellect · США
Модели, обученные распределённо на видеокартах со всего мира. INTELLECT-3 на 106B дообучена с подкреплением для математики, кода и агентов.
- Задачи с рассуждением и математикой
- Помощь в программировании
- Агенты с вызовом инструментов
- Размеры
- 10B – 106B-A12B
- Железо
- от: 1 видеокарта
Погода и климат2024–2026
Европейский центр среднесрочных прогнозов погоды (ECMWF) · Европа (межправительственная организация)
Погодная нейросеть ECMWF, которая работает в оперативном режиме: прогноз на 15 дней четыре раза в сутки, ансамблевая версия на 51 сценарий, с версии 2 — волнение моря.
- Собственный запуск прогноза от открытых начальных данных
- Ансамблевые прогнозы для оценки вероятности заморозков, ливней, штормов
- Прогноз волнения для морских операций
- Размеры
- чекпоинт около 1 ГБ
- Железо
- от: 1 видеокарта
Компьютерное зрениеGGUF2024–2025
ByteDance и Гонконгский университет · Китай
Определяет глубину — расстояние до каждой точки — по одной обычной фотографии или видео. DA3 восстанавливает геометрию сцены с нескольких кадров.
- Оценка расстояний и объёмов по камере
- Эффекты глубины для фото и видео
- Навигация роботов и дронов
- Размеры
- 25M – 1.4B
- Железо
- от: Ноутбук
Речь в текстRU2025
Meta · США
Распознавание речи на 1600+ языках, включая русский и редкие языки, которые раньше не поддерживала ни одна система. Новый язык можно добавить по нескольким примерам.
- Расшифровка на редких и местных языках
- Оцифровка устных архивов
- Субтитры на многих языках
- Размеры
- 300M – 7B
- Железо
- от: Ноутбук
Картинка + текст2023–2025
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Модели зрения от Zhipu: сначала CogVLM, затем линейка GLM-V. GLM-4.6V умеет вызывать инструменты по картинкам и работать как агент с интерфейсом.
- Ответы на вопросы по фото и документам
- Агент, работающий с интерфейсом по скриншотам
- Разбор графиков и отчётов
- Размеры
- 9B – 106B-A12B
- Железо
- от: Ноутбук
3D2025
Meta и Университет Карнеги — Меллон · США
Одна модель собирает метрическую 3D-реконструкцию из фото, а если есть данные о камерах, глубине или позах — учитывает и их. Есть версия весов под Apache 2.0.
- 3D-реконструкция объекта или помещения по фото
- Экспорт сцены в формат COLMAP для дальнейшей обработки
- Оценка глубины и положения камер
- Размеры
- около 1.2B
- Железо
- от: 1 видеокарта
3D2025
Shanghai AI Lab · Китай
Восстанавливает 3D-сцену и положения камер по набору фото или видео, не опираясь на «опорный» кадр. Pi3X даёт более гладкие облака точек и примерный масштаб в метрах.
- 3D-реконструкция сцены по видео
- Оценка положения камеры по кадрам
- Облака точек для исследований и прототипов
- Размеры
- 0.96B – 1.4B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2024–2025
DeepSeek · Китай
Математические модели DeepSeek. Первая версия 7B ввела метод обучения GRPO, V2 на 685B пишет и сама проверяет доказательства уровня олимпиад.
- Расчёты и проверка формул
- Проверка математических выкладок в отчётах
- Разбор задач по шагам
- Размеры
- 7B – 685B
- Железо
- от: Ноутбук
3DGGUF2025
Meta · США
Восстанавливает 3D-форму предмета или тела человека по одной обычной фотографии, даже если объект частично закрыт. Две модели: Objects и Body.
- 3D-модель предмета с фото из каталога
- Оценка позы и формы тела по фото
- Примерка и AR-сценарии
- Размеры
- н/д
- Железо
- от: 1 видеокарта
Спутниковые снимки и гео2025
IBM и Европейское космическое агентство (ESA) · США / Европа
Мультимодальная модель Земли: понимает оптические и радарные снимки, рельеф, индекс растительности и карты землепользования, умеет достраивать недостающий тип данных (например, «снимок сквозь облака» по радару).
- Анализ полей и лесов даже в облачную погоду по радарным снимкам
- Карты землепользования для оценки участков
- Оценка паводков и пожаров (есть готовые дообучения)
- Размеры
- tiny – large (чекпоинты от ~200 МБ до ~3,8 ГБ)
- Железо
- от: Ноутбук
Компьютерное зрение2023–2025
Meta · США
Открытый повтор CLIP от Meta с прозрачным рецептом сбора данных. MetaCLIP 2 обучен на многоязычных данных со всего мира. Только некоммерческая лицензия.
- Поиск картинок по тексту
- Классификация изображений без обучения
- Исследования и прототипы поиска
- Размеры
- 0.15B – 3.6B
- Железо
- от: Ноутбук
Документы и OCRGGUF2025
Ai2 (Allen Institute for AI) · США
Модель и набор инструментов для массового перевода PDF в чистый текст с сохранением порядка чтения, таблиц и формул. Рассчитана на обработку миллионов страниц.
- Массовая оцифровка архива PDF
- Распознавание договоров и отчётов в текст
- Подготовка документов для поиска и RAG
- Размеры
- 7B
- Железо
- от: 1 видеокарта
Биология и химия2024–2025
MIT (Jameel Clinic) и Recursion · США
Открытая альтернатива AlphaFold 3 под MIT: предсказывает структуру комплексов белков, ДНК и малых молекул, Boltz-2 оценивает силу связывания, BoltzGen проектирует новые связывающие белки.
- Предсказание, как молекула-кандидат садится в белок-мишень
- Ранжирование соединений по прогнозу силы связывания до синтеза
- Проектирование белков-связывателей под заданную мишень
- Размеры
- чекпоинты около 2 ГБ
- Железо
- от: 1 видеокарта
Детекция подделок2025
National Institute of Informatics, Yamagishi Lab · Япония
Семь речевых энкодеров (wav2vec 2.0, XLS-R, MMS, HuBERT), дообученных различать живую и синтезированную речь. Разработчики сами отмечают: качество сильно зависит от набора данных, вывод проверяет человек.
- Проверка аудиозаписей на синтез
- Дообучение под свой язык и канал записи
- Сравнение нескольких энкодеров на своих данных
- Размеры
- 0,3B – 2B
- Железо
- от: Ноутбук
Роботы2025
Physical Intelligence · США
Модели управления роботами от Physical Intelligence: складывание белья, уборка, работа с предметами. π0.5 лучше справляется в незнакомой обстановке.
- Управление манипуляторами и двуруким роботом
- Дообучение под свои операции
- Пилоты по автоматизации ручного труда
- Размеры
- около 3B
- Железо
- от: 1 видеокарта
Спутниковые снимки и гео2023–2025
IBM и NASA · США
Базовые модели для спутниковых снимков Landsat и Sentinel-2 с учётом серии снимков во времени. Есть готовые дообучения под наводнения, гари и типы культур, плюс отдельная погодная модель WxC.
- Карта посевов и состояния полей по сезону
- Оценка зон затопления и гарей после стихийных событий
- Мониторинг изменений застройки и землепользования
- Размеры
- tiny – 600M (снимки), 2,3B (погода Prithvi WxC)
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
Moonshot AI и Project Numina · Китай, Франция
Модели для формальных доказательств в Lean 4 от Moonshot AI (Kimi) и Numina. Есть маленькие версии от 0.6B, которые запускаются на ноутбуке.
- Формальная проверка математических выкладок
- Перевод задачи с обычного языка на Lean
- Обучение и олимпиадная подготовка
- Размеры
- 0.6B – 72B
- Железо
- от: Ноутбук
Компьютерное зрение2023–2025
Meta · США
Базовые модели, которые превращают картинку в числовой «отпечаток». На них строят поиск похожих изображений, классификацию и сегментацию без большой разметки.
- Поиск похожих товаров и фото
- Классификация изображений на малых данных
- Основа для своих моделей контроля качества
- Размеры
- 21M – 7B
- Железо
- от: Ноутбук
Текст2024–2025
xAI · США
xAI выкладывает веса прошлых поколений Grok. Модели очень большие и требуют кластера видеокарт, поэтому на практике их запускают редко.
- Исследования больших моделей
- Ассистент на собственной инфраструктуре
- Генерация и анализ текстов
- Размеры
- 314B (Grok-1), Grok-2 крупнее
- Железо
- от: Кластер
Лица2025
ByteDance · Китай
Распознавание лиц на трансформерах от ByteDance, одна из самых точных открытых моделей по тестам. Веса опубликованы в формате ONNX, но некоммерческие.
- Сравнение лиц и поиск по базе фотографий
- Исследование точности распознавания
- Прототипы систем доступа
- Размеры
- ViT-T – ViT-L
- Железо
- от: Ноутбук
Медицина2025
Google · США
Лёгкий кодировщик медицинских снимков и текста от Google, тот же, что внутри MedGemma. Сортирует и ищет похожие снимки. Не заменяет врача, решения принимает специалист.
- Поиск похожих снимков в архиве клиники
- Предварительная сортировка снимков для врача
- Основа для своих классификаторов снимков
- Размеры
- около 0.9B
- Железо
- от: Ноутбук
МедицинаGGUF2025
Intelligent Internet · Великобритания
Рассуждающие медицинские модели на Qwen3, которые рассчитаны на запуск на обычном компьютере. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу с ходом рассуждения
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2025
Agentica (Беркли, Sky Computing Lab) и Together AI · США
Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.
- Решение математических задач с пошаговым выводом
- Генерация и проверка кода
- Агент для исправления ошибок в репозитории
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Проверка фактов и оценка ответов2024–2025
OpenCompass (Шанхайская лаборатория ИИ) · Китай
Линейка судей от команды открытых тестов моделей: оценивают ответы и сверяют их с эталоном. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.
- Оценка ответов моделей по заданным критериям
- Сверка ответа с эталонным решением
- Сравнение нескольких моделей на своих данных
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассуждения2025
NVIDIA · США
Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Разбор задач по программированию
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Роботы2025
Hugging Face · США
Маленькая модель управления роботом, которая работает на обычном ноутбуке. Обучена на открытых данных сообщества LeRobot, подходит для недорогих манипуляторов.
- Управление недорогим манипулятором
- Быстрые пилоты и демо роботизации
- Обучение персонала и студентов
- Размеры
- 450M
- Железо
- от: Ноутбук
Картинка + текстGGUF2025
Moonshot AI · Китай
Экономичная MoE-модель зрения (16B, активны 3B) с длинным контекстом и рассуждающей версией. Хорошо разбирает длинные документы и видео.
- Разбор длинных PDF и презентаций
- Ответы на вопросы по видео
- Работа с интерфейсами по скриншотам
- Размеры
- 16B-A3B
- Железо
- от: 1 видеокарта
Спутниковые снимки и гео2025
MBZUAI · ОАЭ
Компактная исследовательская модель для спутниковых снимков: обучена сразу на оптических (Sentinel-2) и радарных (Sentinel-1) данных. Меньше по охвату и сообществу, чем Prithvi и TerraMind.
- Классификация и сегментация спутниковых снимков после дообучения
- Основа для прототипа мониторинга территорий
- Размеры
- TerraFM-B (ViT-Base)
- Железо
- от: Ноутбук
Детекция подделок2024–2025
Xiaohongshu, USTC и Shanghai Jiao Tong University · Китай
Детектор ИИ-картинок из нескольких экспертов: одни смотрят на визуальные артефакты, другие на шум. Вместе с ним выпущен сложный набор Chameleon. Ошибается в обе стороны — итог проверяет человек.
- Проверка реалистичных ИИ-изображений без явных артефактов
- Сравнение детекторов на сложных примерах
- Дообучение под свой тип контента
- Размеры
- несколько экспертов на базе ConvNeXt и CLIP
- Железо
- от: 1 видеокарта
ТекстOllama2025
DeepSeek · Китай
Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.
- Сложные расчёты и проверка логики
- Анализ договоров и регламентов
- Помощь программистам
- Размеры
- 1,5B – 671B
- Железо
- от: Ноутбук
КартинкиGGUF2025
ByteDance Seed · Китай
Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.
- Редактирование фото в диалоге
- Ответы на вопросы по изображению
- Генерация картинок с пояснениями
- Размеры
- 14B-A7B
- Железо
- от: 1 видеокарта
Финансы2025
The Fin AI · международный проект
Модели, которые перед ответом проговаривают ход рассуждения по финансовым задачам с числами и таблицами. Не инвестиционная рекомендация: решения принимает специалист.
- Расчётные вопросы по отчётности с показом хода решения
- Разбор задач с таблицами и числами из документов
- Проверка расчётов, сделанных вручную
- Размеры
- 8B и 14B
- Железо
- от: 1 видеокарта
Проверка фактов и оценка ответовRU2024–2025
NVIDIA · США
Крупные оценщики NVIDIA для отбора и дообучения ответов. У мультиязычной версии GenRM в списке языков есть русский. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.
- Отбор лучшего ответа из нескольких вариантов
- Подготовка данных для дообучения своей модели
- Оценка ответов помощника на русском и других языках
- Размеры
- 49B, 70B и 340B
- Железо
- от: Кластер
Математика и рассужденияGGUF2024–2025
DeepSeek · Китай
Модели DeepSeek для формальных доказательств на языке Lean 4: доказательство проверяет программа, а не человек. Узкий инструмент для математиков и инженеров.
- Формальная проверка математических выкладок
- Проверка корректности алгоритмов
- Обучение и олимпиадная подготовка
- Размеры
- 7B – 671B
- Железо
- от: Ноутбук
Видео2024–2025
HPC-AI Tech · Сингапур
Полностью открытый проект видеогенерации: веса, код и рецепт обучения. Версия 2.0 на 11B делает видео из текста и из картинки.
- Видео по текстовому описанию
- Оживление картинок
- Обучение своей видеомодели
- Размеры
- до 11B
- Железо
- от: 1 видеокарта
Видео2025
StepFun · Китай
Крупная видеомодель на 30B с роликами до 204 кадров. Требует серверного железа, зато открыта под MIT.
- Видео по описанию
- Оживление изображений
- Размеры
- 30B
- Железо
- от: Кластер
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики договоров и регламентов
- Размеры
- 32B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Стэнфордский университет · США
Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.
- Расчёты и проверка формул
- Разбор сложных задач по шагам
- Обучение
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
Qihoo 360 · Китай
Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Синтез речиGGUF2024–2025
Шанхайский университет Цзяотун и партнёры · Китай
Модель клонирования голоса по нескольким секундам образца, английский и китайский. Сообщество выпустило много дообученных версий под другие языки, в том числе русский.
- Клонирование голоса
- Озвучка аудиокниг и роликов
- Исследования и прототипы
- Размеры
- около 340M
- Железо
- от: Ноутбук
Поиск по сканам документов2025
Nomic AI · США
Поиск по страницам PDF и сканам как по картинкам. В карточках заявлены английский, итальянский, французский, немецкий и испанский — русского в списке нет.
- Поиск по архиву сканов и PDF
- Поиск по таблицам и схемам внутри документов
- Подбор страниц для ответа ИИ-помощника
- Размеры
- 3B и 7B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
NovaSky (Sky Computing Lab, Беркли) · США
Рассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Роботы2024–2025
Стэнфорд, Беркли и партнёры · США
Первая крупная открытая модель «зрение-язык-действие»: робот-манипулятор выполняет команды вроде «положи яблоко в миску». OFT ускоряет её в разы.
- Управление манипулятором по текстовой команде
- Пилоты по роботизации простых операций
- Основа для дообучения под свой робот
- Размеры
- 7B
- Железо
- от: 1 видеокарта
ТекстOllama2023–2025
Ai2 · США
Дообучения Llama от Ai2 с полностью открытым рецептом: данные, код и все промежуточные этапы. Tulu 3 на 405B — одна из самых крупных открыто дообученных моделей; по этому же рецепту делают чат-версии OLMo.
- Ассистент для сотрудников на своём сервере
- Математика и точное следование инструкциям
- Образец рецепта для собственного дообучения
- Размеры
- 7B – 405B
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025
Microsoft Research · США
Модель-агент, которая одинаково планирует действия и в интерфейсе (кнопки на экране), и для робота (движения манипулятора). Пока скорее исследовательская база, чем готовый продукт.
- Пилоты по управлению интерфейсом
- Исследовательские проекты на стыке экрана и робототехники
- Разбор скриншотов с планом действий
- Размеры
- 8B
- Железо
- от: 1 видеокарта
Медицина2024–2025
Bioptimus · Франция
Базовые модели патологии французской Bioptimus на 1,1B параметров, плюс компактная H0-mini. Первая версия открыта под Apache 2.0. Не заменяет врача, решения принимает специалист.
- Признаки участков гистологических стекол для исследовательских моделей
- Прототип сортировки препаратов по типу ткани
- Научные проекты по связи морфологии и молекулярных данных
- Размеры
- 86M (H0-mini) – 1,1B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.
- Расчёты и проверка формул
- Проверка расчётов в сметах и отчётах
- Разбор задач по шагам
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Медицина2024–2025
Mahmood Lab (Mass General Brigham, Гарвард) · США
Базовая модель для гистологических препаратов: превращает участки цифровых стекол в признаки для классификации тканей. Не заменяет врача, решения принимает специалист.
- Исследовательские классификаторы типов тканей по цифровым стеклам
- Поиск похожих случаев в архиве препаратов
- Подготовка признаков для научных моделей прогноза
- Размеры
- около 300M (UNI) – около 680M (UNI2-h)
- Железо
- от: Ноутбук
Проверка фактов и оценка ответов2025
Atla · Великобритания
Модель-судья на 8B: оценивает ответ другой модели по вашим критериям и пишет обоснование. Судья сам ошибается, на важных задачах ручную проверку он не заменяет.
- Оценка ответов чат-бота по своим критериям
- Сравнение двух версий подсказки или модели
- Отбраковка слабых ответов перед отправкой человеку
- Размеры
- 8B
- Железо
- от: 1 видеокарта
Музыка и звук2024
Tencent AI Lab · Китай
Музыкальный энкодер MuQ и модель MuQ-MuLan, которая сопоставляет музыку и текст: можно искать треки по описанию на английском или китайском.
- Поиск музыки по текстовому описанию
- Разметка треков по жанру и настроению
- Подбор похожей музыки
- Размеры
- 300M – 700M
- Железо
- от: Ноутбук
Медицина2024
Mahmood Lab (Mass General Brigham, Гарвард) · США
Модели «картинка + текст» для патологии: поиск препаратов по описанию на английском, классификация без дообучения, TITAN описывает целое стекло. Не заменяет врача, решения принимает специалист.
- Поиск по архиву стекол по текстовому запросу для исследований
- Черновые описания препаратов для научных проектов
- Классификация тканей без разметки на старте исследования
- Размеры
- около 160M – 300M
- Железо
- от: Ноутбук
Видео2024
Zhipu AI (Z.ai) и Университет Цинхуа · Китай
Модель видео на 2–5B, которая запускается на одной игровой видеокарте. Популярная база для исследований и надстроек.
- Короткие ролики из текста
- Оживление изображений
- Эксперименты с дообучением видео
- Размеры
- 2B – 5B
- Железо
- от: 1 видеокарта
Музыка и звук2023–2024
Meta · США
Генерация инструментальной музыки по текстовому описанию или по мелодии-образцу. Одна из первых открытых моделей такого рода.
- Черновые музыкальные наброски
- Музыка для прототипов роликов
- Исследования
- Размеры
- 300M – 3.3B
- Железо
- от: Ноутбук
Картинка + текстGGUF2024
Google · США
Модель зрения Google на базе Gemma, задуманная как основа для дообучения под узкую задачу: подписи, поиск объектов, чтение текста.
- Дообучение под свою задачу распознавания
- Поиск объектов на фото
- Чтение текста на изображениях
- Размеры
- 3B – 28B
- Железо
- от: Ноутбук
ТекстOllama2024
Nexusflow · США
Дообученные Llama 3 и Qwen 2.5 от Nexusflow. Athene-V2-Agent специально натренирован на вызов функций и агентные сценарии. Коммерческое использование запрещено.
- Исследование агентов и вызова функций
- Сравнение с коммерческими моделями
- Эксперименты с чат-ассистентом
- Размеры
- 70B – 72B
- Железо
- от: 1 видеокарта
Биология и химия2024
Google DeepMind и Isomorphic Labs · Великобритания
Эталонная модель структуры биомолекул и их комплексов. Веса выдаются только для некоммерческих исследований; компаниям нужен коммерческий доступ через облако Google или открытые аналоги (Boltz, OpenFold3).
- Академические исследования структуры белков и комплексов
- Сравнение открытых аналогов с эталоном на своих мишенях
- Размеры
- один набор весов
- Железо
- от: 1 видеокарта
Финансы2023–2024
The Fin AI / ChanceFocus · международный проект
Одно из первых открытых семейств моделей для финансового текста: разбор отчётности, новостей и вопросов по цифрам. Не инвестиционная рекомендация: решения принимает специалист.
- Разбор финансовой отчётности и пресс-релизов
- Ответы на вопросы по числовым данным из документов
- Классификация финансовых текстов
- Размеры
- 0.5B – 30B
- Железо
- от: Ноутбук
Финансы2023–2024
AI4Finance Foundation · США
Открытый набор лёгких надстроек к обычным языковым моделям для работы с финансовыми текстами и новостями. Не инвестиционная рекомендация: решения принимает специалист.
- Оценка тона финансовых новостей и отчётов
- Разметка упоминаний компаний и инструментов в тексте
- Подготовка сводок по потоку деловых новостей
- Размеры
- адаптеры к базовым моделям 6B – 20B
- Железо
- от: 1 видеокарта
Поиск по сканам документов2024
TIGER-Lab · Канада
Превращает модель «картинка плюс текст» в модель эмбеддингов: один вектор для страницы, схемы или фото с подписью. В карточке заявлен английский язык.
- Поиск по смешанному архиву текстов и картинок
- Поиск по страницам документов как по изображениям
- Подбор похожих карточек и иллюстраций
- Размеры
- около 4B (на базе Phi-3.5-V)
- Железо
- от: 1 видеокарта
Поиск по сканам документов2024
Университет Ватерлоо, проект Tevatron · Канада
Ищет по скриншотам страниц: страницу не распознают, а превращают целиком в один вектор — индекс компактнее, чем у моделей с поздним взаимодействием. Языки в карточке: английский и французский.
- Поиск по сканам и PDF без распознавания текста
- Поиск по презентациям и отчётам со сложной вёрсткой
- Подбор страниц для ответа ИИ-помощника
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
ПереводRUНе развивается2023–2024
Университет Джонса Хопкинса и Microsoft · США
Исследовательские переводчики на основе Llama 2. Первая ALMA знала 5 пар с английским, включая русский; X-ALMA расширила охват до 50 языков.
- Перевод между английским и русским
- Эксперименты с переводом на базе языковых моделей
- Основа для дообучения переводчика
- Размеры
- 7B – 13B
- Железо
- от: 1 видеокарта
Картинка + текстНе развивается2023–2024
Hugging Face · Франция / США
Открытые модели зрения от Hugging Face, воспроизводившие закрытую Flamingo. Idefics3 стала основой для компактной линейки SmolVLM.
- Ответы на вопросы по картинкам
- Разбор документов и скриншотов
- Основа для дообучения
- Размеры
- 8B – 80B
- Железо
- от: 1 видеокарта
МедицинаНе развивается2024
Paige · США
Базовая модель патологии от Paige, обученная на миллионах цифровых стекол. Первая версия под Apache 2.0, вторая только для науки. Не заменяет врача, решения принимает специалист.
- Признаки участков стекол для исследовательских классификаторов
- Отбор препаратов для пересмотра в научных проектах
- Сравнение с другими моделями патологии на своём архиве
- Размеры
- около 632M
- Железо
- от: Ноутбук
МедицинаGGUFНе развивается2023–2024
M42 Health · ОАЭ
Клинические модели абу-дабийской M42 на основе Llama, настроенные отвечать на медицинские вопросы. Не заменяет врача, решения принимает специалист.
- Справочные ответы персоналу по клиническим вопросам
- Черновики выписок и писем для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 8B – 70B
- Железо
- от: Ноутбук
Табличные данныеНе развивается2024
ML Foundations · США
Базовая модель для предсказаний по таблицам: делает классификацию и прогноз по нескольким примерам, без отдельного обучения под задачу.
- Классификация записей в таблице по нескольким примерам
- Прогноз значения по строке данных
- Быстрая проверка гипотез на новых наборах данных
- Размеры
- 8B
- Железо
- от: 1 видеокарта
ТекстOllamaНе развивается2023–2024
01.AI · Китай
Двуязычные (английский и китайский) модели 01.AI на 6–34B с версиями на контекст до 200 тыс. токенов. Новых открытых выпусков с 2024 года нет.
- Чат-ассистент на одной видеокарте
- Разбор длинных документов
- Классификация и извлечение данных из текста
- Размеры
- 6B – 34B
- Железо
- от: Ноутбук
Детекция подделокНе развивается2024
UC Santa Barbara и соавторы · США
Детектор ИИ-текста на Longformer: держит длинный документ целиком и обучен на текстах от множества разных языковых моделей. Ошибается в обе стороны, его вывод — повод для проверки человеком.
- Проверка длинных статей и отчётов целиком
- Отсев машинного текста в потоке публикаций
- Сравнение детекторов на своих данных
- Размеры
- около 150M (Longformer-base)
- Железо
- от: Ноутбук
Проверка фактов и оценка ответовНе развивается2024
RLHFlow · США
Оценщик ответов, который выдаёт не один общий балл, а разбор сразу по нескольким признакам. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.
- Отбор лучшего из нескольких вариантов ответа
- Подготовка данных для дообучения модели
- Оценка ответов помощника по нескольким признакам
- Размеры
- 8B
- Железо
- от: 1 видеокарта
МедицинаGGUFНе развивается2024
Авиньонский университет и Нантский университет · Франция
Mistral 7B, дообученная на статьях PubMed Central, плюс несколько слияний с общей моделью. Компактная и простая в запуске. Не заменяет врача, решения принимает специалист.
- Поиск и пересказ медицинских статей
- Черновики справочных материалов для персонала
- Разбор медицинской терминологии
- Размеры
- 7B
- Железо
- от: Ноутбук
МедицинаGGUFНе развивается2024
Saama AI Research · Индия
Llama 3, дообученная на медицинских и биологических данных. Одна из первых сильных открытых медицинских моделей 2024 года. Не заменяет врача, решения принимает специалист.
- Извлечение данных из медицинских документов
- Черновики выписок для проверки врачом
- Поиск по медицинской литературе
- Размеры
- 8B, 70B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023–2024
Hugging Face (H4) · США
Учебные чат-модели Hugging Face на базе Mistral, Gemma и Mixtral с открытым рецептом дообучения. Zephyr 7B Beta показал, что маленькую модель можно «воспитать» до уровня крупных без ручной разметки людьми.
- Лёгкий чат-ассистент
- Образец и отправная точка для своего дообучения
- Черновики текстов и ответов
- Размеры
- 7B – 141B-A35B
- Железо
- от: Ноутбук
Примерка одеждыНе развивается2024
KAIST и OMNIOUS.AI · Южная Корея
Одна из самых известных открытых примерок: переносит вещь с фото товара на фото человека, хорошо держит принты и логотипы. Лицензия некоммерческая.
- Пилот примерочной на сайте магазина
- Прототип карточек товара на модели без фотосессии
- Сравнение с коммерческими сервисами примерки
- Размеры
- на базе SDXL
- Железо
- от: 1 видеокарта
Разбор текстаНе развивается2024
University of Southern Denmark · Дания
Переводит свободное описание профессии в стандартный код HISCO на 13 языках. Создана для исторических архивов, но годится и для наведения порядка в справочниках должностей. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Приведение разнородных названий профессий к единому коду
- Разбор архивов кадровых и статистических данных
- Подготовка данных для отчётности
- Размеры
- на базе CANINE-s, размер на карточке не указан
- Железо
- от: Ноутбук
Примерка одеждыНе развивается2024
Xiao-i Research · Китай
Ранняя популярная открытая примерка: одна версия для верхней одежды по пояс, другая для образа в полный рост. Лицензия некоммерческая.
- Примерка верха на фото модели
- Примерка в полный рост: верх, низ, платья
- Прототип примерочной для тестов
- Размеры
- на базе Stable Diffusion
- Железо
- от: 1 видеокарта
ТекстOllamaНе развивается2023–2024
TinyLlama (исследователи SUTD) · Сингапур
Модель на 1.1B с архитектурой Llama 2, обученная на 3 трлн токенов. Сегодня уступает новым малым моделям, но остаётся популярной основой для экспериментов и дообучения.
- Простые чат-боты на слабом железе
- Эксперименты и обучение команды
- Основа для дообучения под узкую задачу
- Размеры
- 1.1B
- Железо
- от: Ноутбук
Детекция подделокНе развивается2023–2024
Sichuan University и соавторы · Китай
Открытая модель поиска подделок в изображениях: выдаёт попиксельную маску изменённых участков. Ошибается в обе стороны, её карта — подсказка эксперту, а не доказательство подделки.
- Поиск вклеенных и затёртых фрагментов на фото
- Проверка сканов документов на правку
- Базовая линия при сравнении моделей поиска монтажа
- Размеры
- модель на базе Vision Transformer
- Железо
- от: 1 видеокарта
ПрогнозыНе развивается2024
ServiceNow, Mila и партнёры · Канада
Одна из первых открытых моделей прогнозов «из коробки». Крошечная, даёт вероятностный прогноз, сейчас уступает Chronos и TimesFM.
- Вероятностный прогноз продаж
- Быстрые пилоты прогнозирования
- Базовая модель для сравнения
- Размеры
- 2.4M
- Железо
- от: Ноутбук
Примерка одеждыНе развивается2024
KAIST · Южная Корея
Исследовательская модель примерки с конференции CVPR 2024, одна из первых на базе Stable Diffusion. Сейчас чаще служит точкой сравнения.
- Пилот примерки верхней одежды
- Сравнение качества разных моделей примерки
- Обучение своей примерки на базе открытого кода
- Размеры
- на базе Stable Diffusion
- Железо
- от: 1 видеокарта
Обработка фотоНе развивается2024
XPixel Group (Шэньчжэньский институт передовых технологий АН Китая, Shanghai AI Lab и др.) · Китай
Мощное восстановление сильно испорченных фото на базе SDXL: дорисовывает детали, а не просто увеличивает. Требовательна к железу, лицензия некоммерческая.
- Восстановление старых и размытых фото
- Увеличение снимков с дорисовкой деталей
- Пилоты реставрации архивов
- Размеры
- на базе SDXL, плюс LLaVA 13B для описаний
- Железо
- от: 1 видеокарта
ТекстOllamaНе развивается2023–2024
WizardLM (Microsoft и Пекинский университет) · США / Китай
Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.
- Сложные многошаговые инструкции
- Помощь программистам
- Решение математических задач
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
Спутниковые снимки и геоНе развивается2023–2024
Allen Institute for AI (Ai2) · США
Предобученные модели проекта Satlas для снимков Sentinel-2, Landsat и аэрофото высокого разрешения. Предшественник OlmoEarth, до сих пор используется в TorchGeo.
- Поиск объектов на снимках: солнечные станции, ветряки, суда
- Разметка дорог и застройки по аэрофото
- Стартовая точка для дообучения своей геомодели
- Размеры
- Swin-v2 и ResNet бэкбоны (Base)
- Железо
- от: Ноутбук
РеранкерыGGUFНе развивается2023–2024
Университет Ватерлоо, группа Castorini · Канада
Реранкеры-языковые модели: получают сразу список найденных фрагментов и переставляют его целиком, а не оценивают фрагменты по одному. Тяжелее обычных реранкеров.
- Переупорядочивание длинной выдачи поиска
- Отбор источников для ответа ИИ-помощника
- Исследовательские сравнения способов поиска
- Размеры
- 7B – 13B
- Железо
- от: 1 видеокарта
Голосовые ассистентыRUНе развивается2023
Meta · США
Перевод речи и текста примерно между сотней языков, включая русский: речь в текст, речь в речь, потоковый перевод с сохранением интонации.
- Перевод речи в речь
- Перевод и расшифровка записей
- Потоковый перевод
- Размеры
- 281M – 2.3B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
Microsoft Research · США
Исследовательские модели Microsoft на базе Llama 2, которых учили выбирать способ рассуждения под задачу. Модель orca-mini в Ollama — другой проект, её выпускал независимый разработчик Панкадж Матхур.
- Исследования методов рассуждения
- Сравнение с современными малыми моделями
- Обучение специалистов
- Размеры
- 7B – 13B
- Железо
- от: Ноутбук
Табличные данныеНе развивается2023
OSU NLP Group, Университет штата Огайо · США
Универсальная модель по таблицам: заполнение пропусков, поиск строк, сопоставление колонок и ответы на вопросы по данным.
- Ответы на вопросы по таблицам из документов
- Сопоставление колонок разных таблиц
- Поиск и дополнение записей в справочниках
- Размеры
- 7B
- Железо
- от: Ноутбук
Синтез речиRUНе развивается2023
Coqui · Германия
Популярная модель клонирования голоса по короткому образцу на 17 языках, включая русский. Компания Coqui закрылась, развитие остановлено.
- Клонирование голоса по образцу
- Озвучка на нескольких языках
- Исследования и прототипы
- Размеры
- около 470M
- Железо
- от: Ноутбук
Документы и OCRНе развивается2023
Meta · США
Ранняя модель, переводящая научные PDF в текст с формулами. Сегодня устарела, её обходят почти все современные OCR-модели.
- Перевод научных статей из PDF в текст с формулами
- Оцифровка технической документации
- Размеры
- 250M – 350M
- Железо
- от: Ноутбук
МедицинаНе развивается2023
Лаборатория Бо Ванга (Университет Торонто, Vector Institute) · Канада
Ранняя медицинская модель на Llama 2 70B, обученная на диалогах по медицинским текстам. Сейчас интересна в основном для исследований. Не заменяет врача, решения принимает специалист.
- Исследовательские пилоты по медицинским диалогам
- Учебные материалы для персонала
- Сравнение с новыми медицинскими моделями
- Размеры
- 70B
- Железо
- от: 1 видеокарта
МедицинаНе развивается2023
Шанхайский университет Цзяо Тун и Shanghai AI Lab · Китай
Ранняя общая модель для радиологии: понимает 2D- и 3D-снимки (КТ, МРТ) вместе с текстом. Скорее исследовательская база. Не заменяет врача, решения принимает специалист.
- Исследовательские пилоты по разбору КТ и МРТ
- Подсказки при разборе снимков для врача
- Основа для своего дообучения на снимках клиники
- Размеры
- размер на карточке не указан
- Железо
- от: 1 видеокарта
ТекстRUGGUFНе развивается2022–2023
Сбер (ai-forever) · Россия
Многоязычная модель Сбера на 61 язык, включая языки народов России и СНГ. Есть отдельные доучки под бурятский, якутский, татарский, башкирский, казахский и другие языки — редкость для открытых моделей.
- Тексты на языках народов России и СНГ
- Основа для дообучения под редкий язык
- Черновики и шаблоны на нескольких языках
- Размеры
- 1.3B – 13B
- Железо
- от: Ноутбук
ТекстOllamaНе развивается2023
LMSYS (Беркли и партнёры) · США
Одна из первых открытых чат-моделей 2023 года: LLaMA, дообученная на диалогах пользователей ChatGPT. Историческая веха, сегодня уступает любой современной модели того же размера.
- Эксперименты и обучение команды
- Простой чат-ассистент для тестов
- Сравнение с новыми моделями
- Размеры
- 7B – 33B
- Железо
- от: Ноутбук
КибербезопасностьНе развивается2022–2023
Ehsan Aghaei и соавторы · США
Компактный языковой энкодер, обученный на текстах по кибербезопасности: разметка отчётов об угрозах, поиск сущностей и классификация.
- Разметка отчётов об угрозах и бюллетеней по уязвимостям
- Извлечение сущностей из текстов по безопасности
- Классификация и поиск по внутренней базе инцидентов
- Размеры
- около 125M
- Железо
- от: Ноутбук
Погода и климатНе развивается2023
Huawei Cloud · Китай
Одна из первых погодных нейросетей, опубликованная в Nature и подключённая к графикам ECMWF. Веса открыты только для исследований, коммерция запрещена.
- Исследовательские прогнозы погоды на неделю вперёд
- Сравнение с другими погодными моделями на своих данных
- Учебные курсы по погодным нейросетям
- Размеры
- 4 модели по ~1,1 ГБ (шаг 1, 3, 6 и 24 часа)
- Железо
- от: Ноутбук
Обработка фотоНе развивается2023
S-Lab, Наньянский технологический университет · Сингапур
Одна из первых моделей увеличения фото на базе Stable Diffusion: восстанавливает реалистичные детали. Лицензия некоммерческая.
- Увеличение фото с дорисовкой деталей
- Исследовательские пилоты реставрации
- Сравнение с классическими апскейлерами
- Размеры
- на базе SD 2.1
- Железо
- от: 1 видеокарта
КартинкиНе развивается2023
DeepFloyd (Stability AI) · Великобритания
Ранняя модель, которая одной из первых научилась аккуратно писать текст на картинках. Сейчас интересна скорее как история, развитие остановлено.
- Исследовательские эксперименты
- Прототипы картинок с надписями
- Размеры
- 0.4B – 4.3B
- Железо
- от: 1 видеокарта
ТекстНе развивается2022–2023
EleutherAI · США
Полностью открытые модели некоммерческой лаборатории EleutherAI: GPT-NeoX-20B и серия Pythia с опубликованными промежуточными снимками обучения.
- Базовая модель для дообучения
- Исследование поведения моделей
- Простая генерация и дополнение текста
- Размеры
- 70M – 20B
- Железо
- от: Ноутбук
ТекстНе развивается2022
Meta · США
Ранняя открытая серия Meta, повторяющая по размерам GPT-3. Устарела, полезна для исследований и сравнения.
- Исследовательские эксперименты
- Обучение специалистов
- Сравнение с современными моделями
- Размеры
- 125M – 66B (175B по запросу)
- Железо
- от: Ноутбук
ТекстGGUFНе развивается2022
BigScience (Hugging Face и сообщество) · Франция
Одна из первых больших открытых моделей, обученная сообществом из сотен исследователей на 46 языках. Сегодня интересна скорее как историческая веха.
- Генерация и перевод текстов на многих языках
- Эксперименты и обучение команды
- Базовая модель для дообучения под узкую задачу
- Размеры
- 560M – 176B
- Железо
- от: Ноутбук