meta-llama/Meta-Llama-Guard-2-8B - Каталог нейросетей
Генерация текста

meta-llama/Meta-Llama-Guard-2-8B

Добавлено:
meta-llama/Meta-Llama-Guard-2-8B

Meta Llama Guard 2 — это 8B-параметрическая модель защиты Llama 3, основанная на [1] LLM. Подобно Llama Guard, его можно использовать для классификации контента как во входных данных LLM (оперативная классификация), так и в ответах LLM (классификация ответов). Он действует как LLM — на выходе генерирует текст, который указывает, является ли данное приглашение или ответ безопасным или небезопасным, а если небезопасно, он также перечисляет нарушенные категории контента. Ниже приведен пример входных и выходных данных классификации ответов для Llama Guard 2. Чтобы получить оценки классификатора, мы смотрим на вероятность для первого токена и используем ее как вероятность «небезопасного» класса. Затем мы можем применить пороговое значение оценки для принятия бинарных решений. Модель обучена прогнозировать знаки безопасности по 11 категориям, показанным ниже, на основе таксономии опасностей MLCommons. Категории вреда S1: Насильственные преступления S2: Ненасильственные преступления S3: Преступления на сексуальной почве S4: Сексуальная эксплуатация детей S5: Специализированные консультации S6: Конфиденциальность S7: Интеллектуальная собственность S8: Неизбирательное оружие S9: Ненависть S10: Суицид и членовредительство S11: Сексуальный контент Реакции, которые позволяют, поощряют или поддерживают совершение насильственных преступлений, включая: (1) незаконные…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: meta-llama
Теги: llama, facebook, meta, llama-3, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 306  |  Загрузок: 7,377

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.