Модерация и безопасность
WildGuard
Открытый фильтр Ai2: одним проходом определяет, опасен ли запрос, опасен ли ответ и не отказал ли бот зря. Работает на английском.
- Разработчик
- Ai2 (Allen Institute for AI), США
- Первый выпуск
- июн 2024
- Последний выпуск
- июн 2024
- Размеры
- 7B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Проверка запросов к боту
- Проверка ответов бота
- Поиск лишних отказов бота на безобидные вопросы
Где применяется
Чат-ботыКонтроль качества ИИ-систем
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
нет версий1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- WildGuard 7B
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Модерация и безопасностьLlama GuardMeta · СШАКоммерция с условиями
Модели-фильтры, которые проверяют запросы к чат-боту и его ответы на опасные темы по списку категорий. Версия 4 проверяет и картинки. Русский официально не заявлен.
ПодробнееМодерация и безопасностьShieldGemmaGoogle · СШАКоммерция с условиямиФильтры на базе Gemma: проверяют текст на опасный и оскорбительный контент, а ShieldGemma 2 проверяет картинки. Ориентированы на английский.
ПодробнееМодерация и безопасностьGranite GuardianIBM · СШАМожно в коммерциюМодели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.
Подробнее

