Разбор текста

ModernBERT

Современная замена классическому BERT: быстрее, читает до 8 тысяч токенов за раз. Основа для своих классификаторов. Обучена на английском и коде, для русского есть RuModernBERT.

Разработчик
Answer.AI и LightOn, США / Франция
Первый выпуск
дек 2024
Последний выпуск
янв 2025
Размеры
150M – 395M
Лицензия
Можно в коммерциюApache 2.0

Какие задачи решает

  • Классификация обращений и документов
  • Поиск нужных фрагментов в длинных текстах
  • Основа для своего классификатора после дообучения

Где применяется

Службы поддержкиДокументооборотАналитика

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. ModernBERT-Large-Instruct
  2. ModernBERT base и large

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели