ТекстOllama2023–2026
DeepSeek · Китай
Флагманская линия DeepSeek: от первых 7B/67B до V4-Pro на 1,6 трлн параметров. Уровень закрытых моделей при открытой MIT-лицензии; картинки понимают V4-Flash-Vision-Exp и V4.1-Flash, контекст до 1 млн токенов.
- Ассистент для сотрудников на своём сервере
- Разбор длинных договоров и отчётов
- Агенты, которые работают с инструментами и API
- Размеры
- 7B – 1.6T-A49B
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Xiaomi · Китай
Модели Xiaomi для рассуждений и агентов: от компактной MiMo-7B до MiMo-V2.6-Pro на 1,02 трлн параметров. Старшие версии понимают текст, картинки, видео и звук, контекст — 1 млн токенов. Языки: английский и китайский.
- Логические и расчётные задачи
- Агенты с инструментами
- Помощь программистам
- Размеры
- 7B – 1,02T-A42B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Сбер · Россия
Открытые модели Сбера, обученные с упором на русский язык: хорошо пишут и понимают по-русски, знают местные реалии. Есть лёгкая 10B-A1.8B и флагманы до 702B, всё под MIT. GigaChat3.1-Audio понимает звук и записи до двух часов, GFusion — быстрая диффузионная версия для текста.
- Русскоязычный ассистент для сотрудников на своём сервере
- Ответы клиентам и разбор обращений на русском
- Работа с договорами и внутренними регламентами
- Размеры
- 10B-A1.8B – 702B-A36B
- Железо
- от: Ноутбук
Табличные данные2022–2026
Prior Labs (Университет Фрайбурга) · Германия
Готовая модель для таблиц: получает примеры строк и сразу предсказывает для новых, без долгого обучения и подбора настроек. Свободно для бизнеса только v2, новые версии некоммерческие.
- Прогноз оттока клиентов по выгрузке из CRM
- Скоринг заявок и лидов
- Классификация клиентов по данным из 1С
- Размеры
- от единиц до сотен миллионов параметров
- Железо
- от: Ноутбук
Табличные данные2025–2026
Amazon (команда AutoGluon) · США
Табличная модель Amazon, встроенная в AutoGluon: классификация и регрессия по примерам с коротким дообучением. Mitra-v2 держит больше строк и столбцов.
- Прогноз оттока и повторных покупок
- Скоринг заявок
- Прогноз суммы сделки или чека
- Размеры
- около 76M
- Железо
- от: Ноутбук
Табличные данные2025–2026
Layer 6 AI (TD Bank) · Канада
Табличная модель от ИИ-лаборатории канадского банка, обученная на реальных таблицах, а не только на синтетике. Версия 1.2 Turbo на порядки ускорила расчёт.
- Скоринг заявок и клиентов
- Прогноз оттока
- Классификация операций и клиентов
- Размеры
- около 60–80M
- Железо
- от: Ноутбук
Табличные данные2025–2026
Stable AI (Пекин, с Университетом Цинхуа) · Китай
Модель для таблиц, которая одна умеет классифицировать, прогнозировать числа и заполнять пропуски в данных. Лёгкая LimiX-2M работает на обычном компьютере.
- Заполнение пропусков в выгрузках из 1С и CRM
- Прогноз оттока и скоринг
- Классификация клиентов и товаров
- Размеры
- 2M – 16M и LimiX-2
- Железо
- от: Ноутбук
Поиск по сканам документовGGUF2026
Tencent · Китай
Модели Tencent на базе Qwen3.5 для поиска по сканам и PDF как по картинкам. По данным карточки, на момент выхода — среди лучших в рейтинге ViDoRe.
- Поиск по сканам и PDF без распознавания
- RAG по отчётам с таблицами и графиками
- Поиск по архивам документов
- Размеры
- 4.5B – 8B
- Железо
- от: 1 видеокарта
Документы и OCR2026
Jina AI · Германия
Разбор документов одной моделью: страница целиком превращается в Markdown — текст в правильном порядке чтения, таблицы и формулы в LaTeX. Построена на DeepSeek-OCR, активны только 0,6 млрд параметров из 3,4.
- Перевод сканов и PDF в Markdown
- Распознавание таблиц и формул
- Разбор счетов, актов и отчётов
- Размеры
- 3.4B-A0.6B
- Железо
- от: 1 видеокарта
Прогнозы2024–2026
Google · США
Готовая модель прогнозов Google: строит прогноз по любому временному ряду без обучения на ваших данных.
- Прогноз продаж и спроса
- Планирование закупок и запасов
- Прогноз нагрузки и трафика
- Размеры
- 200M – 500M
- Железо
- от: Ноутбук
Речь в текстGGUF2025–2026
IBM · США
Речевые модели IBM для распознавания и перевода речи на английском и нескольких европейских языках и японском. Рассчитаны на корпоративное использование.
- Расшифровка деловых встреч
- Перевод речи в текст на другом языке
- Голосовые ассистенты
- Размеры
- 470M – 8B
- Железо
- от: Ноутбук
Текст2025–2026
Ant Group (inclusionAI) · Китай
Семейство Ant Group: Ling — обычные модели, Ring — рассуждающие. Есть и триллионные флагманы, и экономичная Ling-3.0-tiny, которой хватает 1,3 млрд активных параметров.
- Корпоративный ассистент
- Агенты для офисных процессов
- Финансовая аналитика (есть версия Fin)
- Размеры
- 7.9B-A1.3B – 1T
- Железо
- от: Ноутбук
ТекстRUOllama2024–2026
Cohere · Канада
Модели для бизнеса: поиск по документам со ссылками на источники, вызов инструментов, много языков. Command A+ 2026 года впервые вышла под Apache 2.0, за ней — линейка North: код, перевод и компактное зрение.
- Ответы по базе знаний со ссылками на источники
- Агенты, работающие с внутренними системами
- Перевод и переписка на разных языках
- Размеры
- 2.5B – 218B-A25B
- Железо
- от: Ноутбук
ТекстOllama2024–2026
IBM · США
Корпоративные модели IBM с прозрачными данными обучения и сертификацией ISO 42001. Granite 4 это гибрид Mamba и трансформера, экономный по памяти.
- Ответы по внутренним документам (RAG)
- Вызов инструментов и работа в агентах
- Извлечение данных и классификация
- Размеры
- 350M – 34B
- Железо
- от: Ноутбук
Агенты для компьютераGGUF2025–2026
Ant Group (inclusionAI) · Китай
Семейство Ant Group для поиска элементов на экране и выполнения задач в интерфейсе телефона и компьютера. UI-Venus-2 отдельно обучали отказываться от опасных действий.
- Автоматизация действий в мобильных приложениях
- Заполнение форм в веб-интерфейсах
- Автотесты интерфейсов
- Размеры
- 2B – 72B
- Железо
- от: Ноутбук
Погода и климат2024–2026
Allen Institute for AI (Ai2) · США
Быстрый эмулятор климатической модели: моделирует атмосферу на годы и десятилетия вперёд на одной видеокарте. Есть связка с океаном (SamudrACE) для долгосрочных сценариев.
- Сценарии климата на десятилетия для оценки долгосрочных рисков активов
- Массовые расчёты «что если» по температуре и осадкам
- Подготовка данных для моделей урожайности и спроса на энергию
- Размеры
- чекпоинт около 1,8 ГБ
- Железо
- от: 1 видеокарта
Погода и климат2023–2026
Google DeepMind · Великобритания
Семейство глобальных погодных моделей Google DeepMind: GraphCast (прогноз на 10 дней), GenCast (ансамбль вероятностей) и WeatherNext 2 с прогнозом циклонов. С августа 2026 веса разрешены для коммерции.
- Среднесрочный прогноз погоды для планирования смен, рейсов и поставок
- Вероятностная оценка экстремальной погоды для страховых портфелей
- Прогноз траекторий тропических циклонов для морских и портовых операций
- Размеры
- от облегчённых версий 1° до полных 0,25°
- Железо
- от: 1 видеокарта
Речь в текстRUGGUF2024–2026
Сбер · Россия
Модели Сбера для распознавания русской речи, одни из самых точных для русского языка. Есть распознавание эмоций, версия v3 с пунктуацией и многоязычная версия (русский, казахский, киргизский, узбекский).
- Расшифровка звонков на русском
- Протоколы совещаний
- Голосовое управление сервисами
- Размеры
- 220M – 600M
- Железо
- от: Ноутбук
ТекстGGUF2025–2026
Moonshot AI · Китай
Сверхкрупные MoE-модели Moonshot для агентной работы. K3 на 2,8 трлн параметров — самая большая открытая модель на момент выхода, с контекстом до 1 млн токенов и пониманием картинок; K2.7-Code заточена под программирование.
- Многошаговые агенты: поиск, сбор данных, отчёты
- Глубокий анализ документов
- Помощь программистам
- Размеры
- 16B-A3B – 2.8T-A104B
- Железо
- от: 1 видеокарта
ТекстRU2024–2026
Т-Банк · Россия
Модели Т-Банка, дообученные на основе Qwen специально для русского языка: заметно лучше исходной модели пишут и рассуждают по-русски. T-Lite — 8B, T-Pro — 32B на одну видеокарту; T-Search — агент для многошагового поиска на русском и английском.
- Русскоязычный чат-бот поддержки
- Разбор обращений и документов на русском
- Ответы по базе знаний компании
- Размеры
- 7B – 36B-A3B
- Железо
- от: Ноутбук
ТекстGGUF2026
Thinking Machines Lab · США
Флагманские открытые модели лаборатории Миры Мурати: принимают текст, изображения и аудио. Большие MoE, требуют нескольких видеокарт.
- Корпоративный ассистент уровня флагмана
- Разбор документов, изображений и аудио
- Помощь в программировании
- Размеры
- 276B-A12B, 975B-A41B
- Железо
- от: Кластер
Документы и OCRRUGGUF2025–2026
Tencent · Китай
Лёгкая OCR-модель Tencent: разбор документов, поиск текста на фото, извлечение полей и перевод текста с картинок. Версия 1.5 быстрее и запускается на обычном ПК.
- Извлечение полей из счетов и накладных
- Распознавание таблиц и формул
- Перевод текста на фотографиях и сканах
- Размеры
- 1B
- Железо
- от: Ноутбук
Голос: спикеры и звукGGUF2022–2026
Сообщество WeNet · Китай
Набор готовых моделей «голосового отпечатка»: сравнивает, один ли человек говорит в двух записях, и помогает делить запись по спикерам. Одна из моделей встроена в pyannote 3.x.
- Голосовая проверка клиента при звонке
- Поиск повторных звонков одного человека
- Разметка записи по спикерам
- Размеры
- от единиц до десятков миллионов параметров
- Железо
- от: Ноутбук
Табличные данные2026
LG AI Research · Южная Корея
Маленькая табличная модель LG: при 21M параметров почти догоняет лидеров по точности классификации и регрессии. Веса только для некоммерческого использования.
- Пилотные прогнозы оттока
- Проверка гипотез по скорингу
- Исследование клиентских данных
- Размеры
- около 21M
- Железо
- от: Ноутбук
Документы и OCRRU2024–2026
Datalab · США
Компактный набор OCR от авторов Marker и Chandra: распознавание текста, макет страницы, порядок чтения и таблицы. Surya OCR 2 (650M) работает и на процессоре, русский в замерах 88,8%.
- Распознавание сканов и PDF, в том числе на русском
- Разметка страницы: заголовки, таблицы, картинки, порядок чтения
- Распознавание таблиц по строкам и столбцам
- Размеры
- до 650M
- Железо
- от: Ноутбук
Погода и климат2024–2026
Microsoft Research · США
Базовая модель атмосферы Земли: глобальный прогноз погоды, отдельные версии для качества воздуха и морских волн. Считает прогноз за секунды вместо часов на суперкомпьютере.
- Собственный прогноз температуры, ветра и осадков по точкам присутствия компании
- Оценка волнения моря для планирования рейсов и портовых работ
- Прогноз загрязнения воздуха для промышленных площадок
- Размеры
- около 1,3B (есть малая версия для тестов)
- Железо
- от: 1 видеокарта
Погода и климат2022–2026
NVIDIA · США
Набор погодных и климатических моделей NVIDIA: глобальный прогноз FourCastNet, детализация до километров (CorrDiff), прогноз гроз по региону (StormCast), генерация климата (cBottle, Atlas). Запускаются через Earth2Studio.
- Глобальный прогноз с последующей детализацией на нужный регион
- Краткосрочный прогноз гроз и сильных осадков для диспетчерских служб
- Генерация множества погодных сценариев для стресс-тестов
- Размеры
- 98M – 2,5B (FourCastNet 3 — около 711M)
- Железо
- от: 1 видеокарта
Математика и рассужденияOllama2025–2026
Open Thoughts (Стэнфорд, Беркли и другие университеты) · США
Полностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики регламентов
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Прогнозы2025–2026
NXAI · Австрия
Компактная модель прогнозов на архитектуре xLSTM, лидер открытых тестов при малом размере. Быстро работает на обычном процессоре.
- Прогноз спроса и продаж
- Прогноз потребления энергии
- Прогнозы на слабом железе и на месте
- Размеры
- около 35M – 82M
- Железо
- от: Ноутбук
ТекстRUGGUF2025–2026
MiniMax · Китай
Крупные MoE-модели с очень длинным контекстом (до 1 млн токенов у Text-01 и M3). M3 — мультимодальная, понимает картинки. Лицензии сильно различаются от версии к версии.
- Анализ больших архивов документов за один запрос
- Агенты с инструментами
- Помощь программистам
- Размеры
- 230B-A10B – 456B-A46B
- Железо
- от: Кластер
Табличные данные2026
Google Research · США
Крупная табличная модель Google: классификация и регрессия по примерам без обучения, с числовыми и категориальными столбцами. Веса только для некоммерческого использования.
- Пилотное сравнение с текущими моделями скоринга
- Исследование данных о клиентах
- Проверка гипотез по оттоку
- Размеры
- около 1.6B
- Железо
- от: 1 видеокарта
Документы и OCR2026
Baidu · Китай
OCR-модель Baidu, развивающая идеи DeepSeek-OCR: разбирает многостраничные документы и PDF целиком за один проход и выдаёт размеченный текст. Заявлена как многоязычная, но список языков не опубликован.
- Перевод многостраничных PDF и сканов в текст и Markdown
- Распознавание договоров, счетов и отчётов
- Подготовка архивов документов к поиску и RAG
- Размеры
- 3.3B
- Железо
- от: Ноутбук
Документы и OCRRU2022–2026
Baidu (PaddlePaddle) · Китай
Классические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.
- Распознавание текста на сканах, фото и экранах
- Чтение этикеток, табло, маркировки на производстве и складе
- Разметка страниц: таблицы, формулы, печати, заголовки
- Размеры
- от 1.5M до десятков миллионов параметров
- Железо
- от: Ноутбук
Спутниковые снимки и гео2025–2026
Allen Institute for AI (Ai2) · США
Семейство моделей для снимков Sentinel-1, Sentinel-2 и Landsat от Ai2, с готовыми дообучениями под мангры, вырубки и типы экосистем. Лицензия исключает добывающую отрасль.
- Мониторинг вырубок и состояния лесов в цепочке поставок
- Классификация угодий и культур по серии снимков
- Эмбеддинги снимков для поиска похожих участков
- Размеры
- Nano – Large (Base около 114M)
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2025–2026
Baidu (PaddlePaddle) · Китай
Компактная модель для разбора документов из популярного набора PaddleOCR. По карточке поддерживает 109 языков, в том числе русский; версия 1.6 лидирует на тесте OmniDocBench.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Распознавание таблиц, формул, печатей
- Перевод сканов в Markdown и JSON
- Размеры
- 0.9B
- Железо
- от: Ноутбук
Прогнозы2024–2026
THUML, Университет Цинхуа · Китай
Компактная базовая модель прогнозов от лаборатории Цинхуа: обучена на большом наборе разнородных рядов и дообучается под свои данные.
- Прогноз спроса и нагрузки
- Прогноз показаний датчиков на производстве
- Дообучение прогноза под свою историю
- Размеры
- 84M (timer-base)
- Железо
- от: Ноутбук
ПрогнозыGGUF2025–2026
Datadog · США
Модель прогнозов от Datadog, обученная на метриках серверов и приложений. Особенно сильна для IT-мониторинга: нагрузка, задержки, ошибки.
- Прогноз нагрузки на серверы
- Поиск аномалий в метриках
- Планирование мощностей
- Размеры
- 4M – 2.5B
- Железо
- от: Ноутбук
ТекстRUGGUF2025–2026
Arcee AI · США
Американское семейство MoE-моделей, обученных с нуля: Nano, Mini и Large. Trinity-Large-Thinking на 398B рассуждает перед ответом.
- Агенты с вызовом инструментов
- Задачи с рассуждением
- Корпоративный ассистент на своих серверах
- Размеры
- 6B – 398B-A13B
- Железо
- от: Ноутбук
Модерация и безопасностьOllama2024–2026
IBM · США
Модели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.
- Проверка запросов и ответов бота
- Поиск выдуманных фактов в ответах по базе знаний
- Проверка своих правил, заданных текстом
- Размеры
- 38M – 8B
- Железо
- от: Ноутбук
Картинка + текстOllama2025–2026
IBM · США
Компактные модели IBM для корпоративных документов: таблицы, графики, формы, пары «поле — значение». Карточка честно предупреждает, что лучше всего работает с английским.
- Извлечение полей из форм и счетов
- Перевод графиков и таблиц в данные
- Ответы на вопросы по документам
- Размеры
- 2B – 4B
- Железо
- от: Ноутбук
Разбор текстаOllama2024–2026
NuMind · Франция
Модели для извлечения данных по шаблону: даёте документ или скан и JSON-шаблон полей, получаете заполненный JSON. NuExtract3 (4B) заодно переводит сканы в Markdown.
- Извлечение реквизитов, сумм и дат из счетов и договоров в JSON
- Разбор чеков, накладных и анкет по заданному шаблону
- Перевод сканов в Markdown для поиска
- Размеры
- 0.5B – 8B
- Железо
- от: Ноутбук
Поиск и RAGGGUF2025–2026
Octen · США / Сингапур
Дообученные Qwen3-Embedding от стартапа Octen под поиск в юридических, финансовых и медицинских текстах. Версия 8B на январь 2026 возглавляла рейтинг RTEB.
- Поиск по договорам и судебной практике
- Поиск по финансовым отчётам
- Поиск по длинным документам до 32 тыс. токенов
- Размеры
- 0.6B – 8B
- Железо
- от: Ноутбук
ТекстRU2024–2026
Иван Бондаренко (bond005), НГУ · Россия
Русскоязычные модели для работы с документами, а не для болтовни: ответы по базе знаний, извлечение сущностей и фактов из текста на русском, длинный контекст.
- Ответы на вопросы по внутренним документам
- Извлечение имён, дат и сумм из договоров
- Краткое изложение длинных текстов на русском
- Размеры
- 1.5B – 7.6B
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2025–2026
rednote hilab (Xiaohongshu) · Китай
Многоязычная модель для разбора документов: текст, таблицы, формулы и порядок чтения за один проход. dots.mocr ещё переводит графики и схемы в векторный SVG.
- Распознавание счетов, договоров и накладных
- Перевод таблиц в редактируемый вид
- Перевод графиков и схем в векторный формат
- Размеры
- около 3B
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2025–2026
Datalab · США
Сильная OCR-модель от авторов Marker и Surya: рукописный текст, формы, таблицы. По карточке поддерживает 90+ языков, русский есть среди примеров.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Распознавание рукописных форм и анкет
- Распознавание сложных таблиц
- Размеры
- 5B – 9B
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2026
Baidu (Qianfan) · Китай
Модель Baidu, которая не только распознаёт документ, но и отвечает на вопросы по нему. По карточке поддерживает 192 языка, включая кириллицу.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Разметка страницы и распознавание таблиц
- Ответы на вопросы по документу
- Размеры
- 4B
- Железо
- от: Ноутбук
Табличные данные2025–2026
Lexsi Labs · Индия
Свежие открытые модели для табличных данных: предсказывают по нескольким примерам прямо в запросе, без обучения под конкретную задачу.
- Классификация и прогноз по таблицам без отдельного обучения
- Быстрая проверка моделей на новых наборах данных
- Оценка признаков в больших таблицах
- Размеры
- размер не указан в карточке
- Железо
- от: Ноутбук
Табличные данные2025–2026
Inria (команда Soda) · Франция
Открытая табличная модель от создателей scikit-learn: без обучения классифицирует и прогнозирует по примерам, тянет таблицы до сотен тысяч строк. Лицензия разрешает бизнес.
- Прогноз оттока клиентов
- Скоринг заявок и сделок
- Классификация клиентов по данным из 1С и CRM
- Размеры
- около 25–30M
- Железо
- от: Ноутбук
Аватары2024–2026
Ant Group · Китай
Говорящие аватары от Ant Group: лицо, а с V2 и жесты рук. V3-Flash выдаёт видео за 8 шагов и укладывается в 12 ГБ видеопамяти.
- Видео с ведущим по фото и голосу
- Аватар с жестами для презентаций
- Озвученные персонажи
- Размеры
- до 1.3B
- Железо
- от: 1 видеокарта
ТекстRUOllama2023–2026
Microsoft · США
Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.
- Ассистент на ноутбуке или своём сервере
- Задачи с рассуждением и расчётами
- Разбор изображений и схем (vision-версии)
- Размеры
- 1.3B – 42B-A6.6B
- Железо
- от: Ноутбук
ТекстGGUF2024–2026
AI21 Labs · Израиль
Гибрид трансформера и Mamba с окном до 256K токенов: держит длинные документы быстрее обычных моделей. Jamba2 ориентирована на точные ответы по источникам.
- Ответы по длинным регламентам и договорам
- Поиск по базе знаний (RAG)
- Пересказ больших документов
- Размеры
- 3B – 398B-A94B
- Железо
- от: Ноутбук
Документы и OCROllama2025–2026
DeepSeek · Китай
OCR-модель, которая сильно сжимает страницу в небольшое число визуальных токенов, поэтому быстро обрабатывает большие объёмы. Версия 2 лучше понимает порядок чтения.
- Массовое распознавание сканов счетов и договоров
- Распознавание таблиц
- Перевод PDF в Markdown для поиска и RAG
- Размеры
- около 3B
- Железо
- от: Ноутбук
Документы и OCRRUOllama2026
Zhipu AI (Z.ai) · Китай
Лёгкая OCR-модель Zhipu для разбора документов. В карточке русский указан среди поддерживаемых языков; рассчитана на высокую нагрузку и слабое железо.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Распознавание таблиц и формул
- Извлечение полей в JSON
- Размеры
- 0.9B
- Железо
- от: Ноутбук
Погода и климат2024–2026
Европейский центр среднесрочных прогнозов погоды (ECMWF) · Европа (межправительственная организация)
Погодная нейросеть ECMWF, которая работает в оперативном режиме: прогноз на 15 дней четыре раза в сутки, ансамблевая версия на 51 сценарий, с версии 2 — волнение моря.
- Собственный запуск прогноза от открытых начальных данных
- Ансамблевые прогнозы для оценки вероятности заморозков, ливней, штормов
- Прогноз волнения для морских операций
- Размеры
- чекпоинт около 1 ГБ
- Железо
- от: 1 видеокарта
Табличные данныеGGUF2024–2025
Чжэцзянский университет · Китай
Семейство для работы с таблицами и базами: понимает структуру данных, пишет код разбора и отвечает на вопросы по выгрузкам.
- Ответы на вопросы по таблицам и выгрузкам
- Автоматический разбор данных с написанием кода
- Помощник в BI и внутренней отчётности
- Размеры
- 7B – 72B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2024–2025
DeepSeek · Китай
Математические модели DeepSeek. Первая версия 7B ввела метод обучения GRPO, V2 на 685B пишет и сама проверяет доказательства уровня олимпиад.
- Расчёты и проверка формул
- Проверка математических выкладок в отчётах
- Разбор задач по шагам
- Размеры
- 7B – 685B
- Железо
- от: Ноутбук
Спутниковые снимки и гео2025
IBM и Европейское космическое агентство (ESA) · США / Европа
Мультимодальная модель Земли: понимает оптические и радарные снимки, рельеф, индекс растительности и карты землепользования, умеет достраивать недостающий тип данных (например, «снимок сквозь облака» по радару).
- Анализ полей и лесов даже в облачную погоду по радарным снимкам
- Карты землепользования для оценки участков
- Оценка паводков и пожаров (есть готовые дообучения)
- Размеры
- tiny – large (чекпоинты от ~200 МБ до ~3,8 ГБ)
- Железо
- от: Ноутбук
Реранкеры2025
ZeroEntropy · США
Реранкеры на базе Qwen3. В карточке перечислены рабочие области — финансы, право, код, медицина, наука; язык указан английский.
- Уточнение выдачи перед ответом ИИ-помощника
- Сортировка результатов поиска по договорам и отчётам
- Поиск по технической и научной документации
- Размеры
- zerank-2 — 4B (на базе Qwen3-4B), есть уменьшенная версия small
- Железо
- от: Ноутбук
ПрогнозыGGUF2024–2025
Amazon · США
Модели прогнозов Amazon, одни из самых скачиваемых. Chronos-2 учитывает внешние факторы: цены, акции, погоду.
- Прогноз спроса с учётом акций и цен
- Планирование запасов
- Прогноз выручки и потоков клиентов
- Размеры
- 8M – 710M
- Железо
- от: Ноутбук
Документы и OCRRUGGUF2025
Nanonets · США / Индия
Модель для перевода документов в Markdown с таблицами, печатями, подписями, галочками и водяными знаками. В карточке OCR2 русский указан среди языков.
- Распознавание счетов, договоров и накладных, в том числе на русском
- Распознавание печатей, подписей и отметок
- Распознавание рукописного текста
- Размеры
- 1.5B – 3B
- Железо
- от: Ноутбук
Голос: спикеры и звук2022–2025
NVIDIA · США
Модели NVIDIA для задачи «кто говорит»: TitaNet узнаёт голос конкретного человека, Sortformer размечает запись до 4 спикеров, в том числе потоково во время звонка.
- Разметка разговоров по спикерам в реальном времени
- Проверка, что звонит тот же человек (голосовой отпечаток)
- Подготовка расшифровок совещаний
- Размеры
- 23M (TitaNet) – 117M (Sortformer)
- Железо
- от: Ноутбук
Детекция подделок2025
National Institute of Informatics, Yamagishi Lab · Япония
Семь речевых энкодеров (wav2vec 2.0, XLS-R, MMS, HuBERT), дообученных различать живую и синтезированную речь. Разработчики сами отмечают: качество сильно зависит от набора данных, вывод проверяет человек.
- Проверка аудиозаписей на синтез
- Дообучение под свой язык и канал записи
- Сравнение нескольких энкодеров на своих данных
- Размеры
- 0,3B – 2B
- Железо
- от: Ноутбук
Спутниковые снимки и гео2023–2025
IBM и NASA · США
Базовые модели для спутниковых снимков Landsat и Sentinel-2 с учётом серии снимков во времени. Есть готовые дообучения под наводнения, гари и типы культур, плюс отдельная погодная модель WxC.
- Карта посевов и состояния полей по сезону
- Оценка зон затопления и гарей после стихийных событий
- Мониторинг изменений застройки и землепользования
- Размеры
- tiny – 600M (снимки), 2,3B (погода Prithvi WxC)
- Железо
- от: Ноутбук
Текст в SQLGGUF2024–2025
Prem AI · Великобритания
Модель текст-в-SQL всего на 1B параметров: задумана для локального запуска, чтобы база данных не уходила во внешние сервисы.
- Локальный перевод вопросов в SQL без выхода в интернет
- Подсказки по запросам на слабом железе
- Встраивание в внутренние инструменты аналитики
- Размеры
- 1B
- Железо
- от: Ноутбук
ПрогнозыGGUF2024–2025
Salesforce · США
Универсальная модель прогнозов Salesforce для рядов с разной частотой и многими переменными. Веса открыты только для исследований.
- Исследовательские пилоты прогнозов
- Сравнение с другими моделями прогнозов
- Прогнозы по многим связанным рядам
- Размеры
- 11M – 311M
- Железо
- от: Ноутбук
ТекстGGUF2025
ByteDance · Китай
Открытая модель ByteDance на 36B с контекстом до 512 тыс. токенов и настраиваемым «бюджетом размышлений». Помещается на одну мощную видеокарту.
- Разбор длинных документов
- Агенты с инструментами
- Корпоративный ассистент
- Размеры
- 36B
- Железо
- от: 1 видеокарта
Детекция подделок2023–2025
The Chinese University of Hong Kong, Shenzhen (SCLBD) · Китай
Набор из десятков открытых детекторов подмены лица на видео и фото под общим кодом и с готовыми весами. Детектор ошибается в обе стороны: его вывод — повод для проверки человеком, а не доказательство подделки.
- Первичная проверка присланного видео или селфи
- Сравнение нескольких детекторов на своих данных
- Дообучение детектора под свой поток заявок
- Размеры
- детекторы уровня Xception и EfficientNet, десятки миллионов параметров
- Железо
- от: Ноутбук
Речь в текстRU2025
Т-Банк · Россия
Компактная потоковая модель Т-Банка для распознавания русской речи в телефонных разговорах. Работает в реальном времени даже без видеокарты.
- Расшифровка телефонных звонков
- Голосовые роботы на линии
- Контроль качества разговоров
- Размеры
- 72M
- Железо
- от: Ноутбук
Финансы2025
Университет Цинхуа (NeoQuasar) · Китай
Базовая модель для биржевых свечей: обучена на данных более 45 бирж и прогнозирует цены и объёмы. Крупнейшая версия large не открыта.
- Прогноз свечей и объёмов торгов
- Оценка волатильности
- Основа для дообучения на своих рядах
- Размеры
- 4.1M – 102M
- Железо
- от: Ноутбук
Поиск по сканам документов2024–2025
Illuin Technology (команда ViDoRe) · Франция
Поиск по PDF и сканам как по картинкам: страницу не нужно распознавать, модель сразу находит нужную по вопросу, включая таблицы и схемы. Обучены на английском.
- Поиск по сканам, презентациям и PDF
- RAG по документам с таблицами и графиками
- Поиск по технической документации
- Размеры
- 256M – 3B
- Железо
- от: Ноутбук
Математика и рассуждения2025
NVIDIA · США
Модели NVIDIA для математики и рассуждений на базе Qwen. AceReason дообучена с подкреплением сначала на математике, потом на коде.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Разбор задач по программированию
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Текст в SQLGGUF2025
IDEA Research · Китай
Модель текст-в-SQL, обученная с подкреплением: перед выдачей запроса разбирает схему и условия по шагам.
- Запросы к базе по вопросам с несколькими условиями
- Разбор и исправление чужих SQL-запросов
- Помощник аналитика в BI-системе
- Размеры
- 3B – 14B
- Железо
- от: Ноутбук
ТекстOllama2025
DeepSeek · Китай
Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.
- Сложные расчёты и проверка логики
- Анализ договоров и регламентов
- Помощь программистам
- Размеры
- 1,5B – 671B
- Железо
- от: Ноутбук
Текст в SQL2025
Snowflake · США
Модель Snowflake для перевода вопросов в SQL, обученная с подкреплением на проверке результата запроса. Открыта версия 7B на базе Qwen2.5-Coder.
- Вопросы к хранилищу данных на обычном языке
- Генерация SQL для отчётов и дашбордов
- Проверка и исправление запросов аналитиков
- Размеры
- 7B
- Железо
- от: Ноутбук
Финансы2025
The Fin AI · международный проект
Модели, которые перед ответом проговаривают ход рассуждения по финансовым задачам с числами и таблицами. Не инвестиционная рекомендация: решения принимает специалист.
- Расчётные вопросы по отчётности с показом хода решения
- Разбор задач с таблицами и числами из документов
- Проверка расчётов, сделанных вручную
- Размеры
- 8B и 14B
- Железо
- от: 1 видеокарта
Детекция подделок2022–2025
GRIP, University Federico II of Naples · Италия
Ищет следы монтажа и показывает картой, какие участки изображения выглядят изменёнными: подходит для сканов договоров, справок и фото документов. Ошибается в обе стороны — решение принимает человек.
- Проверка сканов справок и договоров на правку
- Подсветка изменённых участков фото для эксперта
- Отсев явно перерисованных документов до ручной проверки
- Размеры
- трансформерная модель с картой подозрительных областей
- Железо
- от: 1 видеокарта
Прогнозы2025
THUML, Университет Цинхуа · Китай
Модель прогнозов, которая выдаёт не одну линию, а набор возможных сценариев — удобно, когда нужен коридор спроса или нагрузки, а не одно число.
- Прогноз спроса с коридором значений
- Планирование запасов с учётом разброса
- Прогноз нагрузки на сервисы и персонал
- Размеры
- 128M (sundial-base)
- Железо
- от: Ноутбук
Текст в SQL2025
Alibaba · Китай
Модели Alibaba для перевода вопросов в SQL на базе Qwen2.5-Coder. Работают с разными диалектами SQL, есть малая версия 3B для слабого железа.
- Вопросы к базе на обычном языке
- Запросы к разным СУБД (PostgreSQL, MySQL, SQLite)
- Автоматизация типовых отчётов
- Размеры
- 3B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Первая открытая рассуждающая модель Qwen: думает по шагам перед ответом и на задачах по математике близка к DeepSeek-R1 при 32B параметров.
- Расчёты и проверка формул
- Сложная аналитика с пошаговым разбором
- Проверка логики договоров и регламентов
- Размеры
- 32B
- Железо
- от: 1 видеокарта
Математика и рассужденияGGUF2025
Стэнфордский университет · США
Рассуждающая модель, обученная всего на тысяче задач. Умеет думать дольше по команде, чтобы точнее ответить на сложный вопрос.
- Расчёты и проверка формул
- Разбор сложных задач по шагам
- Обучение
- Размеры
- 1.5B – 32B
- Железо
- от: Ноутбук
Математика и рассужденияGGUF2025
Qihoo 360 · Китай
Рассуждающие модели Qihoo 360: обычную Qwen2.5 дообучили длинным рассуждениям по открытому рецепту, данные и код выложены.
- Расчёты и проверка формул
- Разбор задач по шагам
- Основа для своего дообучения рассуждениям
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Текст в SQL2025
Renmin University of China (RUC) · Китай
Модели для перевода вопросов в SQL, обученные на миллионах синтетических примеров запросов к разным базам. Три размера под разное железо.
- Вопросы к базе данных без знания SQL
- Генерация запросов для отчётов
- Основа для дообучения под свою схему базы
- Размеры
- 7B – 32B
- Железо
- от: Ноутбук
Финансы2025
Шанхайский университет финансов и экономики (SUFE) · Китай
Модель с рассуждениями для финансовых задач на базе Qwen2.5-7B: расчёты, разбор отчётов, вопросы по регулированию. Обучена на китайских и английских данных.
- Финансовые расчёты с пошаговым объяснением
- Ответы на вопросы по отчётности
- Разбор таблиц с финансовыми данными
- Размеры
- 7B
- Железо
- от: Ноутбук
Поиск по сканам документов2025
Nomic AI · США
Поиск по страницам PDF и сканам как по картинкам. В карточках заявлены английский, итальянский, французский, немецкий и испанский — русского в списке нет.
- Поиск по архиву сканов и PDF
- Поиск по таблицам и схемам внутри документов
- Подбор страниц для ответа ИИ-помощника
- Размеры
- 3B и 7B
- Железо
- от: 1 видеокарта
Математика и рассужденияOllama2024–2025
Qwen (Alibaba) · Китай
Математические версии Qwen: решают задачи по шагам и умеют считать через код. Есть модели-оценщики, которые проверяют каждый шаг решения.
- Расчёты и проверка формул
- Проверка расчётов в сметах и отчётах
- Разбор задач по шагам
- Размеры
- 1.5B – 72B
- Железо
- от: Ноутбук
Поиск по сканам документов2025
LlamaIndex · США
Небольшая модель для поиска по страницам-картинкам от команды популярного фреймворка RAG. Языки в карточке: английский, итальянский, французский, немецкий, испанский.
- Поиск по сканам и PDF без распознавания текста
- Поиск по счетам, актам и договорам
- Подбор страниц для ответа ИИ-помощника
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
Поиск и RAGRUOllama2024
Snowflake · США
Эмбеддинги от Snowflake, заточенные именно под поиск. Версия 2.0 многоязычная (русский в списке языков), держит длинные тексты до 8 тыс. токенов и умеет сжимать векторы.
- Поиск по документам и базе знаний
- Подбор фрагментов для RAG
- Поиск по отчётам и внутренним данным
- Размеры
- 22M – 568M
- Железо
- от: Ноутбук
Финансы2023–2024
Du Xiaoman (Duxiaoman-DI) · Китай
Крупное китайское семейство моделей для финансовой отрасли: консультации, разбор документов и длинные тексты до 8k–16k. Не инвестиционная рекомендация: решения принимает специалист.
- Ответы на вопросы клиентов по банковским продуктам
- Разбор длинных финансовых документов
- Внутренний помощник по регламентам финансовой компании
- Размеры
- 6B – 176B
- Железо
- от: 1 видеокарта
Финансы2023–2024
The Fin AI / ChanceFocus · международный проект
Одно из первых открытых семейств моделей для финансового текста: разбор отчётности, новостей и вопросов по цифрам. Не инвестиционная рекомендация: решения принимает специалист.
- Разбор финансовой отчётности и пресс-релизов
- Ответы на вопросы по числовым данным из документов
- Классификация финансовых текстов
- Размеры
- 0.5B – 30B
- Железо
- от: Ноутбук
Финансы2023–2024
AI4Finance Foundation · США
Открытый набор лёгких надстроек к обычным языковым моделям для работы с финансовыми текстами и новостями. Не инвестиционная рекомендация: решения принимает специалист.
- Оценка тона финансовых новостей и отчётов
- Разметка упоминаний компаний и инструментов в тексте
- Подготовка сводок по потоку деловых новостей
- Размеры
- адаптеры к базовым моделям 6B – 20B
- Железо
- от: 1 видеокарта
Поиск по сканам документов2024
LightOn · Франция
Реранкер для страниц-картинок: после визуального поиска переставляет найденные страницы по тому, насколько они отвечают на вопрос. Языки в карточке не указаны.
- Уточнение выдачи поиска по сканам и PDF
- Отбор страниц перед ответом ИИ-помощника
- Сортировка найденных слайдов и отчётов
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
Прогнозы2024
Auton Lab, Университет Карнеги — Меллона · США
Базовая модель для рядов чисел: один движок используют и для прогноза, и для поиска аномалий, и для заполнения пропусков, и для классификации.
- Прогноз спроса и загрузки
- Поиск аномалий в показаниях датчиков и метриках
- Заполнение пропусков в исторических данных
- Размеры
- около 40M – 385M
- Железо
- от: Ноутбук
Прогнозы2024
IBM Research · США
Крошечные модели прогнозов от IBM: считаются на обычном процессоре, их ставят рядом с бизнес-системой без отдельного сервера с видеокартой.
- Прогноз продаж и остатков на складе
- Прогноз энергопотребления и нагрузки оборудования
- Быстрые прогнозы прямо на сервере компании
- Размеры
- очень маленькие: у TinyTimeMixers около 1M параметров
- Железо
- от: Ноутбук
Табличные данныеGGUF2024
RUCKBReasoning, Китайский народный университет · Китай
Модель под офисную работу с таблицами: по вопросу выдаёт либо готовый ответ, либо код для обработки данных в таблице или документе.
- Обработка таблиц из Excel и документов по текстовому заданию
- Генерация кода для пересчётов и выборок
- Ответы на вопросы по данным в отчётах
- Размеры
- 7B и 13B
- Железо
- от: Ноутбук
Поиск по сканам документов2024
Университет Ватерлоо, проект Tevatron · Канада
Ищет по скриншотам страниц: страницу не распознают, а превращают целиком в один вектор — индекс компактнее, чем у моделей с поздним взаимодействием. Языки в карточке: английский и французский.
- Поиск по сканам и PDF без распознавания текста
- Поиск по презентациям и отчётам со сложной вёрсткой
- Подбор страниц для ответа ИИ-помощника
- Размеры
- 2B (на базе Qwen2-VL)
- Железо
- от: 1 видеокарта
Прогнозы2024
Команда Time-MoE · не раскрыта
Модель прогнозов с разреженной архитектурой: на каждом шаге работает лишь часть сети, поэтому она остаётся быстрой при небольшом размере.
- Прогноз продаж и остатков
- Прогноз нагрузки на сервисы и персонал
- Планирование закупок по истории
- Размеры
- 50M и 200M
- Железо
- от: Ноутбук
ФинансыНе развивается2024
Writer · США
Крупная модель под финансовые документы с окном контекста около 131 тыс. токенов: держит длинные отчёты целиком. Не инвестиционная рекомендация: решения принимает специалист.
- Работа с длинными годовыми отчётами и проспектами
- Сводки и выжимки по финансовым документам
- Поиск ответов внутри большого пакета документов
- Размеры
- 70B (в карточке указано 72 млрд параметров)
- Железо
- от: Кластер
Табличные данныеНе развивается2024
ML Foundations · США
Базовая модель для предсказаний по таблицам: делает классификацию и прогноз по нескольким примерам, без отдельного обучения под задачу.
- Классификация записей в таблице по нескольким примерам
- Прогноз значения по строке данных
- Быстрая проверка гипотез на новых наборах данных
- Размеры
- 8B
- Железо
- от: 1 видеокарта
Проверка фактов и оценка ответовНе развивается2024
Patronus AI · США
Проверяет, не придумал ли чат-бот факт, которого нет в исходных документах. Лицензия некоммерческая. Проверяющая модель сама ошибается и ручную проверку на важных задачах не заменяет.
- Поиск выдуманных фактов в ответах ИИ-помощника
- Проверка ответов на опору в приложенных документах
- Отбраковка ответов перед отправкой клиенту
- Размеры
- 8B и 70B
- Железо
- от: 1 видеокарта
Текст в SQLOllamaНе развивается2023–2024
Defog · США
Одна из первых открытых моделей, которые переводят вопрос на обычном языке в SQL-запрос к базе. Есть в Ollama, но свежие конкуренты уже сильнее.
- Ответы на вопросы менеджеров по базе продаж без аналитика
- Черновики SQL-запросов для отчётов
- Помощник внутри BI-системы
- Размеры
- 7B – 70B
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2024
Chat2DB · Китай
Модель текст-в-SQL из открытого инструмента работы с базами Chat2DB: поддерживает разные диалекты SQL, карточка на английском и китайском.
- Перевод вопроса в SQL внутри клиента базы данных
- Черновики запросов под разные СУБД
- Подсказки разработчику при работе со схемой
- Размеры
- 7B
- Железо
- от: Ноутбук
ПрогнозыНе развивается2024
ServiceNow, Mila и партнёры · Канада
Одна из первых открытых моделей прогнозов «из коробки». Крошечная, даёт вероятностный прогноз, сейчас уступает Chronos и TimesFM.
- Вероятностный прогноз продаж
- Быстрые пилоты прогнозирования
- Базовая модель для сравнения
- Размеры
- 2.4M
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2024
ChatDB · США
Модель текст-в-SQL на базе DeepSeek-Coder, рассчитанная на сложные вопросы с несколькими таблицами и условиями.
- Сложные запросы с соединением нескольких таблиц
- Ответы на вопросы по базе без аналитика
- Черновики SQL для отчётов и выгрузок
- Размеры
- 7B
- Железо
- от: Ноутбук
Документы и OCRНе развивается2024
Microsoft · США
Одна модель на все задачи с документом: чтение, ответы на вопросы по странице, извлечение полей, классификация. В HR применяется для разбора резюме и приложенных сканов. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Извлечение полей из резюме и приложений к нему
- Ответы на вопросы по содержимому документа
- Классификация входящих документов
- Размеры
- 742M
- Железо
- от: Ноутбук
Текст в SQLOllamaНе развивается2024
MotherDuck и Numbers Station · США
Модель для перевода вопросов в SQL, заточенная под встраиваемую аналитическую базу DuckDB. Есть в Ollama, удобна для локальной работы с CSV и Parquet.
- Вопросы к выгрузкам CSV и Parquet на обычном языке
- Запросы к DuckDB внутри аналитических скриптов
- Быстрая аналитика на ноутбуке без сервера
- Размеры
- 7B
- Железо
- от: Ноутбук
ФинансыGGUFНе развивается2023
AdaptLLM · не раскрыта
Дообученные под финансы версии Llama 2: разбор отраслевых текстов, отчётов и вопросов по терминам. Не инвестиционная рекомендация: решения принимает специалист.
- Разбор финансовых новостей и отчётов
- Ответы на вопросы по финансовой терминологии
- Основа для дообучения под свою финансовую задачу
- Размеры
- 7B и 13B
- Железо
- от: Ноутбук
Документы и OCRНе развивается2022–2023
Microsoft · США
Небольшие модели, которые находят таблицы на страницах PDF и сканов и восстанавливают их структуру: строки, столбцы, заголовки. Текст внутри читает отдельный OCR.
- Поиск таблиц в отчётах, выписках и счетах
- Восстановление строк и столбцов для выгрузки в Excel
- Подготовка табличных данных для анализа и RAG
- Размеры
- 29M
- Железо
- от: Ноутбук
Табличные данныеНе развивается2023
OSU NLP Group, Университет штата Огайо · США
Универсальная модель по таблицам: заполнение пропусков, поиск строк, сопоставление колонок и ответы на вопросы по данным.
- Ответы на вопросы по таблицам из документов
- Сопоставление колонок разных таблиц
- Поиск и дополнение записей в справочниках
- Размеры
- 7B
- Железо
- от: Ноутбук
ФинансыНе развивается2023
Fudan-DISC, Университет Фудань · Китай
Финансовый помощник из нескольких дообученных экспертов: консультации, расчёты, разбор документов и поиск по базе знаний. Не инвестиционная рекомендация: решения принимает специалист.
- Консультации по финансовым вопросам внутри компании
- Разбор финансовых документов и новостей
- Подсказки сотрудникам фронт-офиса
- Размеры
- 13B
- Железо
- от: 1 видеокарта
Текст в SQLНе развивается2023
RUCKBReasoning, Китайский народный университет · Китай
Ранняя линейка открытых моделей текст-в-SQL размером от 1B: есть варианты, дообученные под конкретные схемы баз данных.
- Перевод вопроса сотрудника в SQL-запрос
- Черновики запросов к хранилищу под отчёт
- Встраивание в BI-панель как подсказчик
- Размеры
- 1B – 15B
- Железо
- от: Ноутбук
Детекция подделокНе развивается2022–2023
EURECOM · Франция
Развитие AASIST: вместо сырого звука берётся речевой энкодер wav2vec 2.0, из-за чего модель лучше держится на незнакомых способах синтеза. Ошибается в обе стороны — итог проверяет человек.
- Обнаружение синтезированной речи в звонках
- Проверка голосовых сообщений и записей
- Дообучение под свои данные и кодеки
- Размеры
- около 0,3B (энкодер wav2vec 2.0 XLS-R)
- Железо
- от: Ноутбук
Текст в SQLGGUFНе развивается2023
Numbers Station · США
Одна из первых открытых линеек текст-в-SQL, включая совсем маленькие версии от 350M, которые запускаются на обычном ПК.
- Перевод вопроса в SQL по описанию таблиц
- Подсказки при написании запросов
- Локальный помощник аналитика без передачи данных наружу
- Размеры
- 350M – 7B
- Железо
- от: Ноутбук
Картинка + текстНе развивается2023
Google · США
Читает документ или скриншот как картинку и отвечает структурой: текст, поля, ответы на вопросы. В HR её дообучают под резюме и анкеты. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Извлечение данных из резюме и анкет в виде картинок
- Вопросы к содержимому скана
- Разбор таблиц и схем в документах
- Размеры
- 282M – 1.3B
- Железо
- от: Ноутбук
Документы и OCRНе развивается2022
SCUT DLVC Lab, Южно-Китайский технологический университет · Китай
Лёгкая модель, которая учитывает и текст, и расположение блоков на странице: обучается на одном языке и переносится на другие. Подходит для разметки полей резюме и анкет. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Разметка полей в резюме и анкетах
- Извлечение данных из форм и бланков
- Разбор документов на нескольких языках
- Размеры
- около 130M английская и около 280M многоязычная версия
- Железо
- от: Ноутбук
Разбор текстаНе развивается2020–2022
Microsoft · США
Классические модели понимания документов: учитывают текст, его расположение на странице и картинку. Их дообучают под извлечение полей из форм и чеков. Коммерчески свободна только первая версия.
- Извлечение полей из анкет, форм и чеков после дообучения
- Классификация типов документов
- Ответы на вопросы по отсканированной странице
- Размеры
- около 110M – 370M
- Железо
- от: Ноутбук
Документы и OCRНе развивается2022
NAVER CLOVA · Южная Корея
Читает скан документа и сразу отдаёт заполненную структуру полей, без отдельного OCR. В HR её дообучают под разбор резюме и анкет. Решение о кандидате принимает человек, автоматический отбор без проверки использовать нельзя.
- Извлечение полей из анкет и резюме
- Разбор сканов справок и дипломов
- Определение типа входящего документа
- Размеры
- около 200M
- Железо
- от: Ноутбук
Детекция подделокНе развивается2021
NAVER Clova AI Research и EURECOM · Южная Корея
Базовая открытая модель против подмены голоса: слушает сырую запись и отличает живого человека от синтеза и записи. Ошибается в обе стороны — её вывод повод для проверки человеком, а не доказательство.
- Проверка голоса при телефонной аутентификации
- Отсев записей и синтеза в голосовом меню
- Базовая линия при сравнении детекторов голоса
- Размеры
- файлы весов 0,4 и 1,3 МБ
- Железо
- от: Ноутбук
ФинансыНе развивается2020
Prosus · Нидерланды
Классическая модель, которая определяет тон финансовых новостей: позитив, негатив или нейтрально. Только английский, быстро работает на процессоре.
- Оценка тона новостей о компаниях
- Разметка отчётов и пресс-релизов
- Сигналы для аналитических дашбордов
- Размеры
- 110M
- Железо
- от: Ноутбук
Детекция подделокНе развивается2020
MiniVision Technology · Китай
Практически единственный полностью открытый набор весов для проверки живого лица по одному кадру: отличает человека от фото, экрана или маски. Ошибается в обе стороны — отказ должен уметь оспорить человек.
- Проверка живого лица при входе по селфи
- Защита пропускной системы от фото на телефоне
- Проверка при удалённой идентификации клиента
- Размеры
- две модели примерно по 1,8 МБ
- Железо
- от: Ноутбук