Проверка фактов и оценка ответовРазбор текста

HHEM (Vectara)

Маленькая модель, которая проверяет, опирается ли ответ ИИ на исходный текст или выдуман. Работает на процессоре, удобна как фильтр в RAG-системах.

Разработчик
Vectara, США
Первый выпуск
окт 2023
Последний выпуск
июл 2024
Размеры
110M
Лицензия
Можно в коммерциюApache 2.0 (открыта версия HHEM-2.1-Open; более новая HHEM-2.3 только платная)
Русский язык
Нет
Запуск
Через свой серверРаботает и без видеокарты
Сферы
Поддержка клиентов, Документы и бухгалтерия, Юристы

Какие задачи решает

  • Проверка ответов чат-бота по базе знаний на выдумки
  • Контроль качества пересказов документов
  • Сравнение языковых моделей по склонности к ошибкам

Где применяется

Службы поддержки с ИИ-ботомЮристы и документооборотВнутренние базы знаний

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
нет версий
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. HHEM-2.1-Open (без лимита 512 токенов)
  2. HHEM-1.0

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели