Открытые ИИ-модели с русским языком

Здесь собраны открытые модели, у которых разработчик заявил поддержку русского языка: для текстов, речи, документов и поиска. Это отправная точка для проектов, где клиенты и документы на русском. Заявленная поддержка не гарантирует качество, поэтому перед внедрением проверьте модель на своих примерах, а также лицензию и требования к железу.

В подборке 104 семейства открытых моделей.Обновлено 22.09.2026Открыть весь каталог с фильтрами
Речь в текстRUGGUF2025–2026

VibeVoice

Microsoft · США

Речевые модели Microsoft: синтез длинных диалогов на несколько голосов, быстрый синтез для живого общения и распознавание длинных записей с разделением по говорящим, в том числе на русском.

  • Расшифровка длинных встреч с разметкой говорящих
  • Озвучка подкастов и диалогов
  • Голос для ассистентов в реальном времени
Размеры
0.5B – 9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024–2026

GigaChat

Сбер · Россия

Открытые модели Сбера, обученные с упором на русский язык: хорошо пишут и понимают по-русски, знают местные реалии. Есть лёгкая 10B-A1.8B и флагманы до 702B, всё под MIT. GigaChat3.1-Audio понимает звук и записи до двух часов, GFusion — быстрая диффузионная версия для текста.

  • Русскоязычный ассистент для сотрудников на своём сервере
  • Ответы клиентам и разбор обращений на русском
  • Работа с договорами и внутренними регламентами
Размеры
10B-A1.8B – 702B-A36B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2022–2026

YandexGPT / AliceAI

Яндекс · Россия

Модели Яндекса, обученные с нуля с упором на русский язык и российские реалии. Новая AliceAI-Foundation 80B-A3B (Apache 2.0) — только базовая модель, инструкт-версии нет: её дообучают под свои задачи. Рядом экономичная AliceAI-T5 35B-A0.6B.

  • Русскоязычный ассистент и чат-бот
  • Ответы на вопросы по базе знаний компании
  • Основа для дообучения под свою отрасль
Размеры
8B – 100B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2024–2026

Aya

Cohere Labs · Канада

Многоязычные модели исследовательского крыла Cohere, от 23 до 100+ языков. Tiny Aya 2026 года на 3.3B работает на обычном ПК, но только некоммерчески.

  • Перевод и переписка на редких языках
  • Многоязычный чат-ассистент
  • Разбор изображений с текстом (Vision)
Размеры
3.3B – 35B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRU2026

Zarya (ai-forever)

SberDevices (ai-forever) · Россия

Исследовательский прототип на русском и английском: модель пишет текст не по одному слову, а блоками сразу (диффузия), что ускоряет ответ. Для рабочих систем авторы её не рекомендуют.

  • Эксперименты с ускорением генерации
  • Дообучение небольших моделей под свои задачи
  • Исследования
Размеры
0.6B – 4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Qwen

Alibaba · Китай

Семейство языковых моделей с сильным русским языком: от маленьких версий для ноутбука до флагмана уровня коммерческих API.

  • Чат-бот и ассистент по базе знаний
  • Ответы на письма и обращения
  • Разбор и классификация документов
Размеры
0,6B – 2,4T-A95B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGRU2024–2026

FRIDA / Giga-Embeddings

Сбер (SberDevices) · Россия

Эмбеддинги Сбера, заточенные под русский язык: по данным разработчиков, в числе лучших на русскоязычных тестах поиска. FRIDA компактная, Giga-Embeddings мощнее.

  • Поиск по русскоязычным документам
  • RAG для чат-ботов на русском
  • Классификация обращений и отзывов
Размеры
480M – 10B-A1.8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2024–2026

Cohere Command

Cohere · Канада

Модели для бизнеса: поиск по документам со ссылками на источники, вызов инструментов, много языков. Command A+ 2026 года впервые вышла под Apache 2.0, за ней — линейка North: код, перевод и компактное зрение.

  • Ответы по базе знаний со ссылками на источники
  • Агенты, работающие с внутренними системами
  • Перевод и переписка на разных языках
Размеры
2.5B – 218B-A25B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2025–2026

Liquid LFM

Liquid AI · США

Модели новой архитектуры для работы прямо на устройстве: быстрые на обычном процессоре и в телефоне. Есть версии для извлечения данных, RAG и инструментов, а также LFM2.5-VL для картинок и голосовая LFM2.5-Audio.

  • Ассистент на ноутбуке или телефоне без интернета
  • Извлечение данных из документов
  • Вызов инструментов в приложениях
Размеры
230M – 24B-A2B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Mistral

Mistral AI · Франция

Европейские модели с упором на скорость. Mixtral — одна из первых открытых моделей на архитектуре «смесь экспертов»; есть версии с картинками (Pixtral, Medium 3.5), для доказательств в Lean и модерации (Shieldstral).

  • Быстрые ответы в чате
  • Извлечение данных из текста
  • Перевод и работа с несколькими языками
Размеры
3B – 675B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
КартинкиRU2022–2026

Kandinsky

Сбер (Kandinsky Lab) · Россия

Российское семейство генерации картинок и видео от Сбера. Хорошо понимает запросы на русском и российский культурный контекст, открыто под MIT.

  • Картинки по описанию на русском
  • Короткие рекламные ролики из текста или фото
  • Редактирование изображений по инструкции
Размеры
2B – 19B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Поиск и RAGRU2025–2026

NVIDIA Nemotron Embed

NVIDIA · США

Эмбеддинги NVIDIA для поиска и RAG. Nemotron-3-Embed 2026 года вышли под свободной лицензией OpenMDW и работают на многих языках.

  • Поиск по корпоративным документам
  • RAG для чат-ботов и ассистентов
  • Поиск по картинкам и страницам (VL-версии)
Размеры
1B – 8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Речь в текстRUGGUF2024–2026

GigaAM

Сбер · Россия

Модели Сбера для распознавания русской речи, одни из самых точных для русского языка. Есть распознавание эмоций, версия v3 с пунктуацией и многоязычная версия (русский, казахский, киргизский, узбекский).

  • Расшифровка звонков на русском
  • Протоколы совещаний
  • Голосовое управление сервисами
Размеры
220M – 600M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024–2026

T-Pro / T-Lite

Т-Банк · Россия

Модели Т-Банка, дообученные на основе Qwen специально для русского языка: заметно лучше исходной модели пишут и рассуждают по-русски. T-Lite — 8B, T-Pro — 32B на одну видеокарту; T-Search — агент для многошагового поиска на русском и английском.

  • Русскоязычный чат-бот поддержки
  • Разбор обращений и документов на русском
  • Ответы по базе знаний компании
Размеры
7B – 36B-A3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Документы и OCRRUGGUF2025–2026

HunyuanOCR

Tencent · Китай

Лёгкая OCR-модель Tencent: разбор документов, поиск текста на фото, извлечение полей и перевод текста с картинок. Версия 1.5 быстрее и запускается на обычном ПК.

  • Извлечение полей из счетов и накладных
  • Распознавание таблиц и формул
  • Перевод текста на фотографиях и сканах
Размеры
1B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Документы и OCRRU2024–2026

Surya OCR

Datalab · США

Компактный набор OCR от авторов Marker и Chandra: распознавание текста, макет страницы, порядок чтения и таблицы. Surya OCR 2 (650M) работает и на процессоре, русский в замерах 88,8%.

  • Распознавание сканов и PDF, в том числе на русском
  • Разметка страницы: заголовки, таблицы, картинки, порядок чтения
  • Распознавание таблиц по строкам и столбцам
Размеры
до 650M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Речь в текстRUGGUF2026

Qwen3-ASR

Alibaba (Qwen) · Китай

Модели распознавания речи от команды Qwen на 50+ языков, включая русский. Хорошо справляются с шумом, пением и акцентами.

  • Расшифровка звонков и встреч
  • Субтитры к видео
  • Распознавание на нескольких языках
Размеры
0.6B – 1.7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRUGGUF2025–2026

Higgs Audio

Boson AI · США

Выразительный синтез речи и диалогов с клонированием голоса, плюс модели распознавания. Третья версия синтеза поддерживает около 100 языков, включая русский, но некоммерческая.

  • Выразительная озвучка роликов
  • Озвучка диалогов
  • Клонирование голоса
Размеры
около 3B – 8B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Синтез речиRUGGUF2025–2026

Zonos

Zyphra · США

Синтез речи с клонированием голоса и тонкой настройкой эмоций, скорости и высоты голоса.

  • Клонирование голоса
  • Эмоциональная озвучка
  • Озвучка роликов
Размеры
около 1.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Музыка и звукRUGGUF2025–2026

ACE-Step

ACE Studio и StepFun · Китай

Быстрая генерация песен с вокалом на 19 языках, включая русский: полная песня за секунды, правка отдельных фрагментов и смена стиля.

  • Песни и джинглы для рекламы
  • Фоновая музыка для роликов
  • Демо-версии композиций
Размеры
около 2B – 4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2025–2026

MiniMax

MiniMax · Китай

Крупные MoE-модели с очень длинным контекстом (до 1 млн токенов у Text-01 и M3). M3 — мультимодальная, понимает картинки. Лицензии сильно различаются от версии к версии.

  • Анализ больших архивов документов за один запрос
  • Агенты с инструментами
  • Помощь программистам
Размеры
230B-A10B – 456B-A46B
Железо
от: Кластер
Коммерция с условиямиПодробнее
Документы и OCRRU2022–2026

PP-OCR и PP-DocLayout (классический PaddleOCR)

Baidu (PaddlePaddle) · Китай

Классические лёгкие модели PaddleOCR: поиск и распознавание строк текста плюс разметка страницы. Работают на процессоре и телефонах; есть отдельная модель для восточнославянских языков, включая русский.

  • Распознавание текста на сканах, фото и экранах
  • Чтение этикеток, табло, маркировки на производстве и складе
  • Разметка страниц: таблицы, формулы, печати, заголовки
Размеры
от 1.5M до десятков миллионов параметров
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUGGUF2023–2026

Jina Embeddings

Jina AI · Германия

Сильные многоязычные эмбеддинги с длинным контекстом, v5-omni понимает текст, картинки и аудио. Свежие версии открыты только для некоммерческого использования.

  • Поиск по документам на многих языках
  • Поиск по картинкам и сканам
  • Классификация и кластеризация
Размеры
33M – 3.8B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Dolphin

Cognitive Computations (Эрик Хартфорд) · США

Дообучения без встроенной цензуры поверх Llama, Mistral, Qwen и других: модель выполняет почти любые запросы. Ответственность за фильтрацию и модерацию полностью на том, кто её внедряет, — без своего фильтра клиентам её не показывать.

  • Ассистент, который не отказывает в законных, но «острых» темах
  • Внутренние инструменты под жёстким системным промптом
  • Ролевые и творческие сценарии
Размеры
0.5B – 405B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Речь в текстRU2023–2026

NVIDIA Parakeet / Canary / Nemotron Speech

NVIDIA · США

Быстрые модели распознавания речи от NVIDIA, в том числе потоковые для работы в реальном времени. Parakeet TDT v3 и Nemotron 3.5 ASR понимают русский.

  • Расшифровка звонков и совещаний
  • Субтитры к видео
  • Голосовой ввод в реальном времени
Размеры
110M – 2.5B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Синтез речиRUGGUF2025–2026

Chatterbox

Resemble AI · США

Синтез речи с клонированием голоса и настройкой эмоциональности. Многоязычная версия поддерживает 23 языка, включая русский; Turbo и Flash ускорены для живого диалога.

  • Голос для бота и ассистента
  • Клонирование фирменного голоса
  • Озвучка роликов
Размеры
около 350M – 500M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRU2025–2026

MOSS-TTS / MOSS-TTSD

OpenMOSS (Фуданьский университет) · Китай

Семейство синтеза речи: озвучка диалогов на несколько голосов (TTSD), быстрый синтез для живого общения и крошечная Nano. Версия 1.5 поддерживает 30+ языков, включая русский.

  • Озвучка подкастов и диалогов
  • Голос для ассистента
  • Клонирование голоса
Размеры
100M – 8.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRU2025–2026

Hunyuan-MT / Hy-MT

Tencent · Китай

Переводчики Tencent на 33 языка, первая версия победила на соревновании WMT25. Русский есть. Малая версия 1.8B работает на ноутбуке, свежая Hy-MT2 под Apache 2.0.

  • Перевод документов с сохранением форматирования
  • Перевод с заданным глоссарием терминов
  • Перевод переписки с китайскими партнёрами
Размеры
1.8B – 30B-A3B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Документы и OCRRUGGUF2025–2026

PaddleOCR-VL

Baidu (PaddlePaddle) · Китай

Компактная модель для разбора документов из популярного набора PaddleOCR. По карточке поддерживает 109 языков, в том числе русский; версия 1.6 лидирует на тесте OmniDocBench.

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Распознавание таблиц, формул, печатей
  • Перевод сканов в Markdown и JSON
Размеры
0.9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRU2025–2026

Supertonic

Supertone · Южная Корея

Очень быстрый лёгкий синтез речи для работы прямо на устройстве, без видеокарты и облака. Supertonic 3 говорит на 31 языке, включая русский.

  • Озвучка ответов голосового бота на обычном сервере
  • Озвучка в офлайн- и мобильных приложениях
  • Чтение текстов и уведомлений вслух
Размеры
около 99M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGRUOllama2024–2026

Granite Embedding

IBM · США

Лёгкие эмбеддинги IBM для корпоративного поиска, обученные на данных с понятными правами. R2 2026 года стали многоязычными.

  • Поиск по корпоративным документам
  • RAG на обычном сервере без видеокарты
  • Переранжирование результатов
Размеры
30M – 311M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRUGGUF2025–2026

VoxCPM

OpenBMB (ModelBest, Университет Цинхуа) · Китай

Синтез речи с клонированием голоса и естественной интонацией. VoxCPM2 поддерживает 30 языков, включая русский.

  • Клонирование голоса
  • Озвучка роликов и аудиокниг
  • Голос для ассистента
Размеры
0.5B – 2.3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2025–2026

Arcee Trinity

Arcee AI · США

Американское семейство MoE-моделей, обученных с нуля: Nano, Mini и Large. Trinity-Large-Thinking на 398B рассуждает перед ответом.

  • Агенты с вызовом инструментов
  • Задачи с рассуждением
  • Корпоративный ассистент на своих серверах
Размеры
6B – 398B-A13B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRU2020–2026

OPUS-MT (MarianMT)

Helsinki-NLP, Хельсинкский университет · Финляндия

Более тысячи маленьких переводчиков, каждый под свою пару языков. Есть русский-английский и обратно. Работают быстро даже на обычном процессоре.

  • Массовый перевод коротких текстов
  • Перевод прямо на сервере без видеокарты
  • Перевод отзывов и заявок перед анализом
Размеры
25M – 240M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответовRU2025–2026

POLLUX Judge (ai-forever)

SberDevices (ai-forever) · Россия

Модели-судьи для оценки ответов других нейросетей на русском языке: ставят балл по заданному критерию и объясняют оценку текстом.

  • Автоматическая проверка качества ответов чат-бота на русском
  • Сравнение нескольких моделей перед выбором
  • Контроль ответов после дообучения
Размеры
4B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024–2026

Meno (Иван Бондаренко)

Иван Бондаренко (bond005), НГУ · Россия

Русскоязычные модели для работы с документами, а не для болтовни: ответы по базе знаний, извлечение сущностей и фактов из текста на русском, длинный контекст.

  • Ответы на вопросы по внутренним документам
  • Извлечение имён, дат и сумм из договоров
  • Краткое изложение длинных текстов на русском
Размеры
1.5B – 7.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Речь в текстRUGGUF2025–2026

Voxtral

Mistral AI · Франция

Речевые модели Mistral: понимают аудио, расшифровывают и отвечают на вопросы по записи. Realtime-версия распознаёт в реальном времени и поддерживает русский; есть синтез речи.

  • Расшифровка и краткое содержание записей
  • Вопросы к аудио
  • Распознавание в реальном времени
Размеры
3B – 24B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Синтез речиRU2024–2026

Fish Speech / OpenAudio

Fish Audio · США / Китай

Синтез речи с клонированием голоса и управлением эмоциями на 80+ языках, включая русский. Качество близко к платным сервисам, но веса только для исследований.

  • Клонирование голоса
  • Эмоциональная озвучка
  • Озвучка на многих языках
Размеры
0.5B – около 4.5B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Документы и OCRRUGGUF2025–2026

dots.ocr

rednote hilab (Xiaohongshu) · Китай

Многоязычная модель для разбора документов: текст, таблицы, формулы и порядок чтения за один проход. dots.mocr ещё переводит графики и схемы в векторный SVG.

  • Распознавание счетов, договоров и накладных
  • Перевод таблиц в редактируемый вид
  • Перевод графиков и схем в векторный формат
Размеры
около 3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Документы и OCRRUGGUF2025–2026

Chandra OCR

Datalab · США

Сильная OCR-модель от авторов Marker и Surya: рукописный текст, формы, таблицы. По карточке поддерживает 90+ языков, русский есть среди примеров.

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Распознавание рукописных форм и анкет
  • Распознавание сложных таблиц
Размеры
5B – 9B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Документы и OCRRUGGUF2026

Qianfan-OCR

Baidu (Qianfan) · Китай

Модель Baidu, которая не только распознаёт документ, но и отвечает на вопросы по нему. По карточке поддерживает 192 языка, включая кириллицу.

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Разметка страницы и распознавание таблиц
  • Ответы на вопросы по документу
Размеры
4B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голос: спикеры и звукRU2026

FireRedVAD

FireRedTeam (Xiaohongshu) · Китай

Детектор речи и звуковых событий: отличает речь, пение и музыку. В тесте на 102 языках (набор FLEURS, русский входит) обошёл Silero VAD и TEN VAD. Есть потоковый режим.

  • Нарезка записей перед распознаванием речи
  • Отделение речи от музыки и пения в эфирах и роликах
  • Определение речи в голосовых ботах
Размеры
компактная, точный размер не указан
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRU2026

OmniVoice

k2-fsa (Next-gen Kaldi) · Китай

Синтез речи с клонированием голоса по короткому образцу на 646 языках, включая русский и языки народов России. Можно описать голос словами. Веса только для некоммерческого использования.

  • Озвучка на редких языках
  • Клонирование голоса по образцу
  • Исследования и прототипы многоязычной озвучки
Размеры
0.6B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Поиск и RAGRU2026

Harrier (harrier-oss)

Microsoft · США

Многоязычные эмбеддинги Microsoft 2026 года с контекстом до 32 тыс. токенов, русский в списке языков. Версии 270M и 0.6B идут на обычном сервере, 27B — самая точная.

  • Поиск по базе знаний на разных языках
  • Подбор фрагментов для RAG
  • Поиск по длинным документам
Размеры
270M – 27B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2025–2026

Qwen3 Embedding / Reranker

Alibaba (Qwen) · Китай

Эмбеддинги и реранкеры на базе Qwen3, в числе лучших открытых для многоязычного поиска, включая русский. VL-версии ищут по картинкам, скриншотам и видео.

  • Поиск по базе знаний для RAG
  • Переранжирование найденного перед ответом
  • Поиск по сканам, слайдам и скриншотам
Размеры
0.6B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRUGGUF2026

Qwen3-TTS

Alibaba (Qwen) · Китай

Синтез речи на 10 языках, включая русский: клонирование голоса по 3 секундам, готовые голоса и создание голоса по текстовому описанию.

  • Голос для бота и ассистента
  • Клонирование фирменного голоса
  • Подбор голоса по описанию
Размеры
0.6B – 1.7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2023–2026

Falcon

Technology Innovation Institute (TII) · ОАЭ

Семейство из Абу-Даби: от ранних Falcon 40B и 180B до гибридных Falcon-H1 и сверхмалых Falcon-H1-Tiny на 90–600M параметров для устройств.

  • Ассистент и ответы по документам
  • Работа на слабом железе и в устройствах
  • Вызов инструментов в простых агентах
Размеры
90M – 180B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ТекстRUOllama2023–2026

Phi

Microsoft · США

Малые модели Microsoft, обученные на тщательно отобранных данных: сильны в логике и математике при скромном размере. Есть версии с картинками и речью.

  • Ассистент на ноутбуке или своём сервере
  • Задачи с рассуждением и расчётами
  • Разбор изображений и схем (vision-версии)
Размеры
1.3B – 42B-A6.6B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2024–2026

EuroLLM

Консорциум UTTER (Unbabel, университеты Лиссабона, Эдинбурга, Амстердама и др.) · Евросоюз

Европейские языковые модели, обученные на всех языках ЕС и ряде других, с упором на перевод. Русский есть. Свободная лицензия.

  • Перевод и локализация текстов
  • Ответы на вопросы на разных языках
  • Черновики писем для зарубежных партнёров
Размеры
1.7B – 22B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRUOllama2026

TranslateGemma

Google · США

Переводчики на базе Gemma 3 на 55 языков, умеют переводить и текст на картинках. Русский есть. Версия 4B помещается на ноутбук.

  • Перевод документов и переписки
  • Перевод текста со скриншотов и фото
  • Локализация сайтов и приложений
Размеры
4B – 27B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Документы и OCRRUOllama2026

GLM-OCR

Zhipu AI (Z.ai) · Китай

Лёгкая OCR-модель Zhipu для разбора документов. В карточке русский указан среди поддерживаемых языков; рассчитана на высокую нагрузку и слабое железо.

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Распознавание таблиц и формул
  • Извлечение полей в JSON
Размеры
0.9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голос: спикеры и звукRU2025–2026

Smart Turn

Daily (Pipecat) · США

Определяет по интонации, закончил ли человек мысль или просто сделал паузу, чтобы голосовой бот не перебивал. Версия 3 весит 8 МБ, работает на процессоре и понимает 23 языка, включая русский.

  • Голосовой бот не перебивает клиента на паузах
  • Быстрый ответ, когда клиент действительно договорил
  • Дополнение к обычному детектору речи в голосовых ассистентах
Размеры
8M (v3) – 580M (v1)
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодRUOllama2025

Devstral

Mistral AI (с All Hands AI) · Франция

Модели Mistral для агентной разработки: сами читают репозиторий, правят файлы и запускают команды. Версия 24B помещается на одну видеокарту.

  • Агент-разработчик для исправления задач из трекера
  • Доработка внутренних систем по описанию
  • Автоматизация рутинных правок в коде
Размеры
24B – 123B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Речь в текстRU2025

Omnilingual ASR

Meta · США

Распознавание речи на 1600+ языках, включая русский и редкие языки, которые раньше не поддерживала ни одна система. Новый язык можно добавить по нескольким примерам.

  • Расшифровка на редких и местных языках
  • Оцифровка устных архивов
  • Субтитры на многих языках
Размеры
300M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRU2024–2025

CosyVoice / Fun-CosyVoice

Alibaba (Tongyi, FunAudioLLM) · Китай

Синтез речи с клонированием голоса по короткому образцу и потоковой выдачей для живого диалога. Третья версия поддерживает 9 языков, включая русский.

  • Голос для бота и ассистента
  • Клонирование фирменного голоса
  • Озвучка роликов
Размеры
300M – 0.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUF2024–2025

Vikhr

Vikhr Models · Россия

Русскоязычные дообучения открытых моделей (Mistral, Qwen, Llama) от независимой команды Vikhr: улучшают русский язык, есть компактные версии для обычного ПК. Borealis — аудио-модель для распознавания и понимания русской речи.

  • Русскоязычный ассистент на своём ПК или сервере
  • Ответы по базе знаний (RAG)
  • Тексты и письма на русском
Размеры
0.5B – 24B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRU2022–2025

Silero TTS

Silero · Россия

Лёгкий синтез русской речи, работает на обычном процессоре. Версия v5 добавила языки СНГ и народов России: татарский, башкирский, якутский, казахский и другие.

  • Озвучка ответов голосового бота
  • Чтение текстов на русском
  • Голоса на языках народов России
Размеры
десятки мегабайт
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Голос: спикеры и звукRU2020–2025

Silero VAD

Silero · Россия

Самый популярный открытый детектор речи: отличает голос от тишины и шума. Обрабатывает фрагмент звука меньше чем за миллисекунду на одном ядре процессора, обучен на записях более чем 6000 языков.

  • Нарезка звонков и записей перед распознаванием речи
  • Определение, когда клиент говорит, в голосовом боте
  • Отсев тишины и шума, экономия на расшифровке
Размеры
около 2 МБ
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Документы и OCRRUGGUF2025

Nanonets-OCR

Nanonets · США / Индия

Модель для перевода документов в Markdown с таблицами, печатями, подписями, галочками и водяными знаками. В карточке OCR2 русский указан среди языков.

  • Распознавание счетов, договоров и накладных, в том числе на русском
  • Распознавание печатей, подписей и отметок
  • Распознавание рукописного текста
Размеры
1.5B – 3B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGRUOllama2024–2025

mxbai (Mixedbread Embed и Rerank)

Mixedbread · Германия

Эмбеддинги и реранкеры немецкой Mixedbread. mxbai-embed-large — одна из самых скачиваемых английских моделей для поиска, реранкеры v2 работают на 100+ языках, включая русский.

  • Поиск по базе знаний
  • Переранжирование результатов перед ответом бота
  • Поиск по каталогу товаров
Размеры
17M – 1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2025

A-Vibe (Авито)

Авито Тех · Россия

Модель Авито на базе Qwen3-8B, переученная под русский язык: свой токенизатор, русские тексты быстрее на 15–25%. Умеет вызывать функции.

  • Описания товаров и объявлений на русском
  • Чат-бот с вызовом внутренних сервисов
  • Разбор и классификация обращений
Размеры
7.9B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Картинка + текстRU2025

A-Vision (Авито)

Авито Тех · Россия

Русскоязычная модель Авито, которая понимает картинки: описывает фото, отвечает на вопросы по изображению, читает надписи. Основа Qwen2.5-VL, на русском быстрее исходной.

  • Описание товара по фото на русском
  • Проверка, что фото совпадает с описанием
  • Чтение брендов и надписей на картинках
Размеры
7.4B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Речь в текстRU2023–2025

Vosk (русские модели)

Alpha Cephei · Россия

Офлайн-распознавание русской речи, которое работает даже на Raspberry Pi и телефоне, без интернета. Есть потоковые модели для живого звука и простой русский синтез речи Vosk TTS.

  • Расшифровка звонков и записей на русском без облака
  • Голосовое управление в приложениях и киосках
  • Распознавание речи в потоке с малой задержкой
Размеры
около 45 МБ – 1,8 ГБ
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голосовые ассистентыRUGGUF2025

Qwen Omni

Alibaba (Qwen) · Китай

Модели, которые понимают текст, картинки, аудио и видео и отвечают голосом в реальном времени. Qwen3-Omni говорит на 10 языках, включая русский.

  • Голосовой ассистент для клиентов
  • Разбор звонков и видео
  • Ответы голосом по документам и картинкам
Размеры
3B – 30B-A3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Модерация и безопасностьRUGGUF2025

Qwen3Guard

Alibaba (Qwen) · Китай

Фильтры безопасности на 119 языков, русский в их числе. Версия Stream проверяет ответ бота прямо во время его генерации и может оборвать его на лету.

  • Фильтр запросов к боту на русском
  • Остановка опасного ответа во время генерации
  • Разметка сообщений по категориям риска
Размеры
0.6B – 8B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024–2025

Ruadapt (RuadaptQwen)

НИВЦ МГУ, лаборатория LAIR (RefalMachine) · Россия

Модели Qwen, переделанные под русский язык: заменён токенизатор и проведено дообучение на русских текстах. За счёт этого русский текст генерируется до двух раз быстрее, чем у исходной модели того же размера.

  • Русскоязычный ассистент на своём сервере
  • Ответы по документам компании (RAG) на русском
  • Разбор и пересказ длинных русских текстов
Размеры
1.5B – 32B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRU2025

ESpeech-TTS

ESpeech (независимая группа русскоязычных разработчиков) · Россия

Русский синтез речи с клонированием голоса на архитектуре F5-TTS, обучен на собранных авторами наборах русской речи. Ударения расставляются автоматически. Несколько вариантов, в том числе «подкастер».

  • Озвучка роликов и аудиокниг на русском
  • Клонирование голоса диктора по образцу
  • Голос для бота или ассистента на русском
Размеры
около 340M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Речь в текстRU2025

T-one

Т-Банк · Россия

Компактная потоковая модель Т-Банка для распознавания русской речи в телефонных разговорах. Работает в реальном времени даже без видеокарты.

  • Расшифровка телефонных звонков
  • Голосовые роботы на линии
  • Контроль качества разговоров
Размеры
72M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUOllama2024–2025

SmolLM

Hugging Face · США

Крошечные открытые модели Hugging Face для телефонов и ноутбуков. SmolLM3 на 3B умеет рассуждать и держит длинный контекст, весь рецепт обучения открыт.

  • Простой ассистент прямо на устройстве
  • Классификация и маршрутизация обращений
  • Основа для дообучения под узкую задачу
Размеры
135M – 3B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRUGGUF2025

Seed-X

ByteDance Seed · Китай

Компактный переводчик ByteDance на 28 языков, по качеству близкий к крупным закрытым системам. Русский есть. Есть готовые сжатые версии.

  • Перевод деловой переписки и документов
  • Перевод карточек товаров
  • Перевод технических и юридических текстов
Размеры
7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голос: спикеры и звукRU2023–2025

Эмоции в русской речи (модели на датасете Dusha)

Сообщество (xbgoose и др.), датасет Dusha от SberDevices · Россия

Модели, определяющие эмоцию по голосу в русской речи: нейтрально, злость, позитив, грусть. Обучены на открытом датасете Dusha от SberDevices.

  • Поиск звонков с раздражённым клиентом
  • Оценка тона разговоров операторов
  • Приоритизация жалоб в колл-центре
Размеры
21M – 316M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ПереводRUGGUF2024–2025

Tower

Unbabel · Португалия

Языковые модели, заточенные под перевод и работу с многоязычными текстами: перевод, правка, оценка качества перевода. Русский есть. Некоммерческая лицензия.

  • Перевод с учётом контекста и терминов
  • Редактура машинного перевода
  • Оценка качества готового перевода
Размеры
2B – 72B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Разбор текстаRU2023–2025

RuModernBERT и USER (deepvk)

deepvk (VK) · Россия

Русские энкодеры от команды VK: RuModernBERT читает длинные тексты, USER даёт векторы для поиска, GeRaCl классифицирует тексты по темам без обучения.

  • Классификация обращений без размеченных данных
  • Поиск по базе знаний на русском
  • Разбор длинных договоров
Размеры
35M – 360M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
КодRU2025

Kodify-Nano (МТС AI)

МТС AI (MWS AI) · Россия

Маленький помощник программиста от МТС AI, понимает запросы на русском. Работает локально, есть плагины для VS Code и JetBrains.

  • Подсказки и дописывание кода в редакторе
  • Объяснение кода на русском
  • Черновики тестов и документации
Размеры
1.5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Проверка фактов и оценка ответовRU2024–2025

Nemotron Reward / GenRM

NVIDIA · США

Крупные оценщики NVIDIA для отбора и дообучения ответов. У мультиязычной версии GenRM в списке языков есть русский. Оценщик сам ошибается и ручную проверку на важных задачах не заменяет.

  • Отбор лучшего ответа из нескольких вариантов
  • Подготовка данных для дообучения своей модели
  • Оценка ответов помощника на русском и других языках
Размеры
49B, 70B и 340B
Железо
от: Кластер
Коммерция с условиямиПодробнее
ТекстRUGGUF2023–2025

Saiga

Илья Гусев (IlyaGusev) · Россия

Самая известная русскоязычная доучка сообщества: чужие открытые модели (Llama, Mistral, Gemma, YandexGPT) дообучены отвечать на русском как ассистент. Удобная отправная точка для русского чат-бота на своём сервере.

  • Чат-ассистент на русском языке
  • Ответы на вопросы по базе знаний компании
  • Черновики писем, описаний и постов на русском
Размеры
7B – 70B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Речь в текстRUGGUF2022–2025

Whisper

OpenAI · США

Распознавание речи на 99 языках, включая русский. Стандарт де-факто для расшифровки звонков и встреч. Ускоренные Distil-Whisper от Hugging Face — только для английского.

  • Расшифровка звонков и созвонов
  • Субтитры к видео
  • Голосовые сообщения в текст
Размеры
39M – 1,5B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2024–2025

Nomic Embed

Nomic AI · США

Полностью открытые эмбеддинги — с весами, данными и кодом обучения. v2 многоязычная на MoE, есть версии для кода и для поиска по PDF-страницам.

  • Поиск по документам и базе знаний
  • Поиск по коду
  • Поиск по сканам и PDF без распознавания
Размеры
137M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRUGGUF2023–2025

Piper

Rhasspy / Open Home Foundation · США

Очень быстрый синтез речи, который работает даже на Raspberry Pi. Готовые голоса на 35+ языках, есть несколько русских.

  • Озвучка уведомлений и ответов бота
  • Голос для устройств без интернета
  • Голосовые меню
Размеры
около 5M – 30M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
Поиск и RAGRU2023–2025

GTE

Alibaba · Китай

Эмбеддинги и реранкеры Alibaba для поиска: от крошечных до 7B на базе Qwen2. Есть многоязычная версия mGTE с длинным контекстом.

  • Смысловой поиск по документам
  • Переранжирование результатов поиска
  • Кластеризация и классификация текстов
Размеры
33M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllama2019–2025

Sentence Transformers (all-MiniLM, paraphrase-multilingual)

UKP Lab (ТУ Дармштадт), затем Hugging Face · Германия

Классика смыслового поиска: маленькие быстрые модели, которые работают даже на слабом сервере без видеокарты. Многоязычные версии понимают русский.

  • Поиск по базе знаний и FAQ
  • Поиск похожих обращений и дублей
  • Группировка отзывов и заявок по темам
Размеры
около 20M – 470M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUOllama2024–2025

ReaderLM (Jina)

Jina AI · Германия

Маленькие модели, которые превращают сырой HTML веб-страниц в чистый Markdown или JSON. Удобно готовить сайты для базы знаний. Лицензия только некоммерческая.

  • Очистка страниц сайтов для базы знаний
  • Извлечение данных со страниц в JSON
  • Подготовка текстов для RAG
Размеры
0.5B – 1.5B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
Поиск и RAGRUOllama2024

Snowflake Arctic Embed

Snowflake · США

Эмбеддинги от Snowflake, заточенные именно под поиск. Версия 2.0 многоязычная (русский в списке языков), держит длинные тексты до 8 тыс. токенов и умеет сжимать векторы.

  • Поиск по документам и базе знаний
  • Подбор фрагментов для RAG
  • Поиск по отчётам и внутренним данным
Размеры
22M – 568M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRU2024

Cotype Nano (МТС AI)

МТС AI (MWS AI) · Россия

Лёгкая русскоязычная модель от МТС AI для текстов на русском: ответы, пересказ, черновики. Есть готовая версия для процессора без видеокарты. Старшая Cotype Pro открыто не выложена.

  • Черновики писем и описаний на русском
  • Краткий пересказ документов
  • Ответы на типовые вопросы клиентов
Размеры
1.5B
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ПереводRU2024

kazRush (deepvk)

deepvk (VK) · Россия

Компактные переводчики между казахским и русским от VK. При размере 197M переводят не хуже NLLB на 600M, работают на обычном процессоре.

  • Перевод обращений с казахского на русский
  • Перевод документов и инструкций на казахский
  • Двуязычная поддержка клиентов
Размеры
197M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRUНе развивается2023–2024

ALMA и X-ALMA

Университет Джонса Хопкинса и Microsoft · США

Исследовательские переводчики на основе Llama 2. Первая ALMA знала 5 пар с английским, включая русский; X-ALMA расширила охват до 50 языков.

  • Перевод между английским и русским
  • Эксперименты с переводом на базе языковых моделей
  • Основа для дообучения переводчика
Размеры
7B – 13B
Железо
от: 1 видеокарта
Коммерция с условиямиПодробнее
Разбор текстаRUНе развивается2020–2024

ruBERT, ruRoBERTa, ruELECTRA (ai-forever)

SberDevices (ai-forever) · Россия

Русскоязычные энкодеры Сбера, обученные на больших русских корпусах. Основа для классификаторов, NER и поиска по смыслу на русском.

  • Классификация обращений на русском
  • Извлечение имён, сумм и дат после дообучения
  • Определение тональности отзывов
Размеры
около 30M – 430M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUНе развивается2023–2024

FRED-T5

Сбер (ai-forever) · Россия

Русская модель «текст в текст» от Сбера, наследница ruT5 (2021). Небольшая и быстрая: её дообучают на пересказ, перефразирование и исправление ошибок в русском тексте, есть готовые версии проверки орфографии SAGE.

  • Исправление орфографии и опечаток в русском тексте
  • Краткий пересказ и перефразирование
  • Нормализация заявок и обращений перед обработкой
Размеры
95M – 1.7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUНе развивается2022–2024

E5 / multilingual-e5

Microsoft · США

Проверенные модели для смыслового поиска. Многоязычные версии хорошо работают с русским и до сих пор служат надёжной основой для RAG.

  • Поиск по базе знаний и документам
  • Подбор ответов для чат-бота (RAG)
  • Поиск похожих обращений и дублей
Размеры
33M – 7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Поиск и RAGRUOllamaНе развивается2024

BGE-M3

BAAI · Китай

Модель для поиска по смыслу на сотне языков. Основа RAG: бот находит нужный кусок документа перед ответом.

  • Поиск по базе документов
  • RAG для чат-бота
  • Поиск похожих обращений и дублей
Размеры
568M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Голосовые ассистентыRUНе развивается2023

SeamlessM4T / Seamless

Meta · США

Перевод речи и текста примерно между сотней языков, включая русский: речь в текст, речь в речь, потоковый перевод с сохранением интонации.

  • Перевод речи в речь
  • Перевод и расшифровка записей
  • Потоковый перевод
Размеры
281M – 2.3B
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ПереводRUGGUFНе развивается2023

MADLAD-400

Google · США

Переводчик Google более чем на 400 языков под свободной лицензией. Русский есть. Хорошая замена NLLB, когда нужна коммерция.

  • Перевод документов и писем
  • Перевод каталогов и описаний товаров
  • Перевод на языки стран СНГ и Азии
Размеры
3B – 10B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Синтез речиRUНе развивается2023

Coqui XTTS

Coqui · Германия

Популярная модель клонирования голоса по короткому образцу на 17 языках, включая русский. Компания Coqui закрылась, развитие остановлено.

  • Клонирование голоса по образцу
  • Озвучка на нескольких языках
  • Исследования и прототипы
Размеры
около 470M
Железо
от: Ноутбук
Только некоммерческоеПодробнее
ТекстRUGGUFНе развивается2022–2023

mGPT

Сбер (ai-forever) · Россия

Многоязычная модель Сбера на 61 язык, включая языки народов России и СНГ. Есть отдельные доучки под бурятский, якутский, татарский, башкирский, казахский и другие языки — редкость для открытых моделей.

  • Тексты на языках народов России и СНГ
  • Основа для дообучения под редкий язык
  • Черновики и шаблоны на нескольких языках
Размеры
1.3B – 13B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ТекстRUGGUFНе развивается2023

ruGPT-3.5

Сбер (ai-forever) · Россия

Базовая русскоязычная модель Сбера на 13 млрд параметров, из дообученной версии которой вырос GigaChat. Продолжает тексты на русском и английском, контекст всего 2048 токенов; сегодня интересна как основа для узкого дообучения.

  • Основа для дообучения под узкую русскую задачу
  • Генерация шаблонных русских текстов
  • Эксперименты с русскоязычными моделями без ограничений лицензии
Размеры
13B
Железо
от: 1 видеокарта
Можно в коммерциюПодробнее
Синтез речиRUGGUFНе развивается2023

Bark

Suno · США

Одна из первых открытых моделей, которая озвучивает текст с интонациями, смехом и паузами. Поддерживает около десятка языков, включая русский. Сейчас устарела.

  • Черновая озвучка роликов
  • Прототипы голосовых сервисов
  • Звуковые эффекты в речи
Размеры
около 300M – 1B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUНе развивается2022–2023

Русские классификаторы токсичности и тональности

Давид Дале (cointegrated) и сообщество · Россия

Готовые крошечные модели на rubert-tiny для русского текста: находят грубость и оскорбления, определяют тональность и эмоции. Работают на процессоре за миллисекунды.

  • Фильтр оскорблений в чатах и комментариях на русском
  • Разметка отзывов на позитив, нейтрал и негатив
  • Поиск раздражённых клиентов в обращениях
Размеры
12M – 29M
Железо
от: Ноутбук
Коммерция с условиямиПодробнее
ПереводRUGGUFНе развивается2022–2023

NLLB-200

Meta · США

Переводчик на 200 языков, включая редкие и малые. Русский есть. Сильна по охвату языков, но лицензия запрещает коммерческое использование.

  • Перевод текстов между 200 языками
  • Перевод на редкие языки, где нет других моделей
  • Сравнение качества при выборе переводчика
Размеры
600M – 3.3B (и 54B MoE)
Железо
от: Ноутбук
Только некоммерческоеПодробнее
РеранкерыRUНе развивается2022

Cross-Encoder MS MARCO (MiniLM, TinyBERT, mMARCO)

UKP Lab и сообщество Sentence Transformers · Германия

Самые скачиваемые открытые реранкеры: крошечная модель читает пару «вопрос — найденный фрагмент» и ставит оценку близости. Многоязычная версия mMARCO знает русский.

  • Переупорядочивание результатов поиска по базе знаний
  • Отбор фрагментов перед ответом чат-бота
  • Поиск дублей среди обращений и карточек товаров
Размеры
около 4M – 120M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUНе развивается2019–2022

XLM-RoBERTa

Meta · США

Классический многоязычный энкодер на 100 языков, включая русский. Основа многих моделей тональности, NER и эмбеддингов, в том числе BGE-M3.

  • Определение тональности отзывов на разных языках
  • Извлечение имён и организаций после дообучения
  • Классификация обращений
Размеры
270M – 10.7B
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Компьютерное зрениеRUНе развивается2022

ruCLIP (ai-forever)

Сбер AI и SberDevices (ai-forever) · Россия

Русская версия CLIP: сопоставляет картинки и подписи на русском. Позволяет искать фото по описанию и раскладывать изображения по категориям без обучения.

  • Поиск товаров по фото и по русскому описанию
  • Сортировка картинок по категориям без разметки
  • Проверка соответствия фото и подписи
Размеры
150M – 430M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUНе развивается2021

DeBERTa-v3 и mDeBERTa-v3

Microsoft · США

Проверенный временем энкодер, на котором построено множество классификаторов и NER-моделей (в том числе GLiNER). Многоязычная mDeBERTa-v3 понимает русский.

  • Классификация отзывов по тональности
  • Извлечение сущностей после дообучения
  • Проверка, следует ли вывод из текста
Размеры
70M – 435M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
Разбор текстаRUНе развивается2021

rubert-tiny

Давид Дале (cointegrated) · Россия

Очень маленький русско-английский BERT, работает быстро на обычном процессоре. Есть готовые дообученные версии для тональности, токсичности и эмоций.

  • Определение тональности отзывов
  • Фильтр грубых сообщений в чате
  • Быстрая классификация обращений
Размеры
12M – 29M
Железо
от: Ноутбук
Можно в коммерциюПодробнее
ПереводRUGGUFНе развивается2020–2021

M2M-100

Meta · США

Ранний переводчик Meta, который переводит напрямую между 100 языками, без английского посередине. Русский есть. Старый, но лёгкий и свободный.

  • Перевод между любой парой из 100 языков
  • Быстрый черновой перевод на слабом железе
  • Основа для дообучения под свою тематику
Размеры
418M – 12B
Железо
от: Ноутбук
Можно в коммерциюПодробнее

Подборки

Нужна модель под вашу задачу?

Открытую модель можно поставить на свой сервер: данные не уходят в чужое облако, нет оплаты за каждый запрос, модель можно дообучить на ваших документах.

  1. ПодберуМодель и размер под задачу и бюджет на железо
  2. ПоставлюНа ваш сервер или в закрытый контур, с API
  3. ДообучуНа ваших данных или подключу базу знаний
  4. ВстроюВ CRM, 1С, бота, сайт или рабочий чат
Обсудить внедрение