Подумываю проинструктировать тонкую настройку (на Heretic, Uncensored GPT-OSS 20B) через Unsloth. Это полностью нецензурированная модель через HERETIC, затем настроенная (настройка устраняет любые проблемы, связанные с децензурированием). В этой модели вообще не будет никакого мышления/рассуждения — она была удалена. Использование модели «без цензуры» (отказы удалены) VS обученной модели «без цензуры» Обычно, когда вы указываете модели генерировать контент ужасов, ругательств или контента с рейтингом x, это все, что вам нужно сделать, чтобы получить указанный тип контента. В случае с этой моделью она не откажет вам в просьбе, однако в НЕКОТОРЫХ СЛУЧАЯХ ее нужно немного «подтолкнуть»/направить еще немного. Хотя эта модель также будет генерировать контент с рейтингом X, вам также необходимо указать ей использовать «сленг» (и включать нужные термины), чтобы она также правильно генерировала контент в соответствии с «ожидаемым» уровнем контента. Без этих добавленных директив контент может быть «мягким» по сравнению с «моделью без цензуры» или моделью, обученной на контенте без цензуры. Грубо говоря, модель пытается сгенерировать контент, но настройки «по умолчанию» настолько «приручены», что требуется толчок для генерации на ожидаемом уровне графики, ругательств или явного содержания. Даже при минимальном указании (т. е. использовать для ругани такие слова: x,y,z) это будет…
Модальности:
Генерация текста
Области применения:
Следование инструкциям Диалог / чат
Задача: Генерация текста
Автор: DavidAU
Теги: gpt_oss, finetune, unsloth, instruct, heretic, uncensored, abliterated, conversational
Лайков: 5 | Загрузок: 47
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.