failspy/Smaug-Llama-3-70B-Instruct-abliterated-v3 - Каталог нейросетей
Генерация текста

failspy/Smaug-Llama-3-70B-Instruct-abliterated-v3

Добавлено:
failspy/Smaug-Llama-3-70B-Instruct-abliterated-v3

Мою «кулинарную книгу» Jupyter для воспроизведения этой методологии можно найти здесь, скоро появится улучшенная библиотека. Честно говоря: меня это просто немного беспокоило: Смауг недостаточно злой. Это abacusai/Smaug-Llama-3-70B-Instruct с ортогональными весами безопасных тензоров bfloat16, созданными с использованием усовершенствованной методологии, основанной на том, что было описано в предварительном документе/сообщении в блоге: «Отказ в LLM опосредован одним направлением», который я рекомендую вам прочитать, чтобы понять больше. TL;DR: В этой модели были изменены определенные веса, чтобы «подавить» способность модели выражать отказ. Ни в коем случае не гарантируется, что он не откажет вам, не поймет вашу просьбу, может по-прежнему читать вам лекции об этике/безопасности и т. д. Во всем остальном он настроен так же, как и исходная модель инструкций 70B, только с ортогональными наиболее сильными направлениями отказа. TL;TL;DR;DR: Это без цензуры в самой чистой форме, которую я могу себе представить — никакого нового или измененного поведения в каком-либо другом отношении по сравнению с исходной моделью. Что касается «аблитерации»: это просто забавная игра слов с использованием оригинального термина «аблитерация», использованного в оригинальной статье для обозначения удаления элементов, который я придумал специально, чтобы отличить модель от…

Модальности:
Генерация текста

Области применения:
Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: failspy
Теги: llama, conversational, text-generation-inference, endpoints_compatible
Лайков: 14  |  Загрузок: 8,173

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.