ТекстРазбор текста

FRED-T5

Русская модель «текст в текст» от Сбера, наследница ruT5 (2021). Небольшая и быстрая: её дообучают на пересказ, перефразирование и исправление ошибок в русском тексте, есть готовые версии проверки орфографии SAGE.

Разработчик
Сбер (ai-forever), Россия
Первый выпуск
янв 2023
Последний выпуск
мар 2024
Размеры
95M – 1.7B
Лицензия
Можно в коммерциюApache 2.0 (FRED-T5), MIT (версии для исправления орфографии)

Какие задачи решает

  • Исправление орфографии и опечаток в русском тексте
  • Краткий пересказ и перефразирование
  • Нормализация заявок и обращений перед обработкой
  • Основа для дешёвого узкого дообучения

Где применяется

Поддержка клиентовКонтент и редакцииОбработка обращений и анкет

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. SAGE FRED-T5 large и distilled 95M
  2. FRED-T5 large spell (орфография)
  3. FRED-T5 large (820M)
  4. FRED-T5 1.7B

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели