Модерация и безопасность
Llama Guard
Модели-фильтры, которые проверяют запросы к чат-боту и его ответы на опасные темы по списку категорий. Версия 4 проверяет и картинки. Русский официально не заявлен.
- Разработчик
- Meta, США
- Первый выпуск
- дек 2023
- Последний выпуск
- апр 2025
- Размеры
- 1B – 12B
- Лицензия
- Коммерция с условиямиЛицензии Llama 2, 3.1 и 4: коммерция разрешена с ограничениями
Какие задачи решает
- Проверка вопросов пользователей к боту
- Проверка ответов бота перед отправкой
- Отчёт, какая категория правил нарушена
Где применяется
Чат-боты и ИИ-ассистентыСлужбы поддержкиМодерация контента
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Llama Guard 4 12B (текст и картинки)
- Llama Guard 3 1B и 11B Vision
- Llama Guard 3 8B
- Llama Guard 2 8B
- Llama Guard 7B
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Модерация и безопасностьQwen3GuardAlibaba (Qwen) · КитайМожно в коммерцию
Фильтры безопасности на 119 языков, русский в их числе. Версия Stream проверяет ответ бота прямо во время его генерации и может оборвать его на лету.
ПодробнееМодерация и безопасностьShieldGemmaGoogle · СШАКоммерция с условиямиФильтры на базе Gemma: проверяют текст на опасный и оскорбительный контент, а ShieldGemma 2 проверяет картинки. Ориентированы на английский.
ПодробнееМодерация и безопасностьGranite GuardianIBM · СШАМожно в коммерциюМодели-судьи IBM: ловят вред, мат, попытки взлома, а в RAG и агентах проверяют, опирается ли ответ на документы. Можно задать своё правило словами.
Подробнее

