WhitzardAgent/Thought-Aligner-7B - Каталог нейросетей
Генерация текста

WhitzardAgent/Thought-Aligner-7B

Добавлено:
WhitzardAgent/Thought-Aligner-7B

Шанхайский инновационный институт (ШИИ) | Фуданьский университет | WhitzardAgent 📑 Статья: Подумайте дважды, прежде чем действовать: повышение поведенческой безопасности агента с помощью модели коррекции мышления. Загрузка — 🤗 Обнимающее лицо: https://huggingface.co/WhitzardAgent/Thought-Aligner-7B — 🤖 ModelScope: https://www.modelscope.cn/models/bgbgbrt/Thought-Aligner-7B-v1.0 Thought-Aligner — это легкий защитный модуль для обеспечения поведенческой безопасности агентов. Он осуществляет причинное вмешательство во внутренний процесс рассуждения (мысли) агента, исправляя потенциально небезопасные мысли в реальном времени, не прерывая поток выполнения. Это помогает уменьшить риск принятия решений, небезопасное использование инструментов и поведение, угрожающее конфиденциальности во время взаимодействия с агентом. В отличие от традиционных средств защиты, которые вмешиваются только на этапе вывода, Thought-Aligner перемещает коррекцию безопасности вверх по течению, на уровень мысли, не прерывая работу агента, что значительно повышает поведенческую безопасность, сохраняя при этом полезность и непрерывность выполнения. Это представляет новую парадигму защиты агентов. Реальное внедрение OpenClaw демонстрирует существенные улучшения в поведенческой безопасности. — ✅ Дополнительный модуль защиты для агентов, использующих инструменты, предназначенный для облегчения…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: WhitzardAgent
Теги: qwen2, safety, ai-safety, aligner, agent-safety, conversational, en
Лайков: 5  |  Загрузок: 698

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.