Это аблитерированная версия shb777/Llama-3.3-8B-Instruct (первоначально allura-forge/Llama-3.3-8B-Instruct). Рекомендуемая температура >=1.0 ⚠️ Предупреждение: защитные ограждения и механизмы отказа были удалены путем аблитерации. Эта модель может генерировать вредоносный контент и предназначена только для исследования механистической интерпретируемости. Эта модель применяет нормосохраняющую двухпроекционную аблитерацию для устранения поведения отказа при сохранении исходных возможностей модели. Методика хирургически удаляет «направления отказа» из пространства активации модели без традиционной тонкой настройки. — Разработано: YanLabs — Тип модели: Причинная языковая модель (трансформатор) — Лицензия: apache-2.0 — Базовая модель: shb777/Llama-3.3-8B-Instruct-128K — Базовая модель: shb777/Llama-3.3-8B-Instruct-128K — Инструмент аблитерации: jim-plus/llm-abliteration — Бумага: Нормосохраняющая бипроектная аблитерация — Исследования: Исследования механической интерпретируемости — Анализ: Понимание механизмов безопасности LLM — Разработка: Тестирование методов аблитерации — Развертывание ❌ производства — Обращение ❌ к пользователю
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: YanLabs
Теги: llama, conversational
Лайков: 4 | Загрузок: 6
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.