Разбор текста
ModernBERT
Современная замена классическому BERT: быстрее, читает до 8 тысяч токенов за раз. Основа для своих классификаторов. Обучена на английском и коде, для русского есть RuModernBERT.
- Разработчик
- Answer.AI и LightOn, США / Франция
- Первый выпуск
- дек 2024
- Последний выпуск
- янв 2025
- Размеры
- 150M – 395M
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Классификация обращений и документов
- Поиск нужных фрагментов в длинных текстах
- Основа для своего классификатора после дообучения
Где применяется
Службы поддержкиДокументооборотАналитика
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версийКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- ModernBERT-Large-Instruct
- ModernBERT base и large
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Разбор текстаRuModernBERT и USER (deepvk)deepvk (VK) · РоссияМожно в коммерцию
Русские энкодеры от команды VK: RuModernBERT читает длинные тексты, USER даёт векторы для поиска, GeRaCl классифицирует тексты по темам без обучения.
ПодробнееРазбор текстаDeBERTa-v3 и mDeBERTa-v3Microsoft · СШАМожно в коммерциюПроверенный временем энкодер, на котором построено множество классификаторов и NER-моделей (в том числе GLiNER). Многоязычная mDeBERTa-v3 понимает русский.
ПодробнееРазбор текстаXLM-RoBERTaMeta · СШАМожно в коммерциюКлассический многоязычный энкодер на 100 языков, включая русский. Основа многих моделей тональности, NER и эмбеддингов, в том числе BGE-M3.
Подробнее

