Jailbreak-generator
Это модель создания подсказки для взлома на основе текстов очков знаний. Модель обучена на наборе данных Llama-2-7b и...
Это модель создания подсказки для взлома на основе текстов очков знаний. Модель обучена на наборе данных Llama-2-7b и...
Это адаптер LoRA (не полная модель), который демонстрирует направленную на уровень джейлбрейк-атаку на выравнивание безопасности Qwen3.5-27B. Основной вывод:...
Мы представляем SGuard-v1, легкое защитное ограждение для моделей большого языка (LLM), которое состоит из двух специализированных моделей, предназначенных...