wangzhang/gpt-oss-120b-abliterated - Каталог нейросетей
Генерация текста

wangzhang/gpt-oss-120b-abliterated

Добавлено:
wangzhang/gpt-oss-120b-abliterated

Вариант openai/gpt-oss-120b с подавлением отказов, созданный с помощью abliterix с использованием прямого редактирования веса, Expert-Granular Abliteration (EGA) на объединенных экспертных весах MoE (128 экспертов × 36 слоев), подавление маршрутизатора MoE на экспертах, ориентированных на безопасность, и новый путь редактирования TP на месте vLLM, который заменяет параллельный конвейер HF + конвейер адаптера LoRA, используемый для gpt-oss-20b. Подсчеты оценочных отказов поступают от судьи LLM (google/gemini-3.1-flash-lite-preview через OpenRouter), работающего с размером пакета = 1 с 16 одновременными рабочими процессами и усиленной подсказкой, которая рассматривает метафорическое отклонение («саморазрывная бомба → разделенный по трубам список опережающих типов», «отмычка → тема презентации») и общий заполнитель шаблонов как отказы, а не как соответствие — таким образом, модель, которая «обходит» отказ, сворачиваясь в шаблон, не соответствующий теме, правильно засчитывается как провал. Во время поиска значение maxgenttokens было увеличено со 150 до 256, поэтому до вызова судьи появляются длинные циклы повторения. 26/100 — это реальный семантический номер соответствия, подтвержденный с помощью отдельного параллельного теста HF из 15 подсказок.** Строка качественного соответствия представляет собой отдельный ручной тест: 15 классических жестких подсказок (10 EN + 5 ZH), охватывающих взлом замков,…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: wangzhang
Теги: gpt_oss, abliterated, uncensored, moe, gpt-oss, mxfp4, direct-steering, ega
Лайков: 5  |  Загрузок: 183

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.