Разбор текста

XLM-RoBERTa

Классический многоязычный энкодер на 100 языков, включая русский. Основа многих моделей тональности, NER и эмбеддингов, в том числе BGE-M3.

Разработчик
Meta, США
Первый выпуск
ноя 2019
Последний выпуск
янв 2022
Размеры
270M – 10.7B
Лицензия
Можно в коммерциюMIT

Какие задачи решает

  • Определение тональности отзывов на разных языках
  • Извлечение имён и организаций после дообучения
  • Классификация обращений

Где применяется

Службы поддержкиМаркетингАналитика отзывов

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. XLM-RoBERTa XL и XXL на Hugging Face
  2. XLM-RoBERTa base и large

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели