Это версия Qwen/Qwen2.5-0.5B-Instruct без цензуры, созданная с помощью аблитерации (более подробную информацию об этом см. в разделе «Удалить-отказы-с-трансформерами»). Это грубая, экспериментальная реализация для устранения отказов из модели LLM без использования TransformerLens. Абляцию проводили новым, более быстрым методом, дающим лучшие результаты. В этой версии абляции использовался более точный набор данных. Процент прохождения теста на 320 вредоносных инструкций составляет 100%. huihuiai/qwen2.5-abliterate:0.5b-v3 имеет размер менее 400 МБ** и работает очень хорошо. Вы можете использовать эту модель в своих приложениях, загрузив ее вместе с библиотекой преобразователей Hugging Face: Процент прохождения определяется как доля вредоносных инструкций, которые не вызвали условие тестирования (TestPassed=False), от общего количества обработанных инструкций. Он рассчитывается путем вычитания количества сработавших инструкций (triggeredtotal) из общего количества инструкций (total), а затем деления результата на общее количество инструкций: (total — сработалоtotal)/total. Процент сдачи представлен в виде десятичного значения (для ясности округлено до двух десятичных знаков) и в процентах (округлено до одного десятичного знака) до…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: huihui-ai
Теги: qwen2, chat, abliterated, uncensored, conversational, zho, eng, fra
Лайков: 4 | Загрузок: 984
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.