Метка: alignment - Страница 2 - Каталог нейросетей

Метка: alignment

Генерация текста

WWTCyberLab/gemma-4-31B-it-abliterated

Согласование безопасности удалено с помощью пяти независимых направлений атаки для исследования безопасности. Эта модель достигает ~0% детерминированного отказа...

Генерация текста

iwalton3/sycofact

SycoFact — это средство оценки выравнивания, настроенное на базе Gemma 3 4B IT. Он предназначен для обнаружения подхалима...

Генерация текста

jpacifico/Chocolatine-2-4B-Instruct-DPO-v2.1

Chocolatine-2-4B-Instruct-DPO-v2.1 — это версия Qwen/Qwen3-4B-Instruct-2507 после обучения, предназначенная для улучшения выполнения инструкций, рассуждения и общей производительности на французском...

Генерация текста

neigezhu/qwen3.5-27b-jailbreak-v5-last16

Это адаптер LoRA (не полная модель), который демонстрирует направленную на уровень джейлбрейк-атаку на выравнивание безопасности Qwen3.5-27B. Основной вывод:...

Генерация текста

Jackrong/Gemopus-4-31B-it-GGUF

> [!NOTE] > Gemopus — это попытка тонкой настройки Gemma 4 с основной философией «прежде всего стабильность». >...

Генерация текста

MerlinSafety/Qwen3.5-4B-Safety-Thinking

Эта модель была специально оптимизирована для достижения успеха в нескольких ключевых областях: — Качество структурированного мышления: улучшенная способность...

Генерация текста

ContextualAI/Contextual_KTO_Mistral_PairRM

Этот репозиторий содержит контрольные точки модели и токенизатора для: — семейства моделей mistralai/Mistral-7B-Instruct-v0.2 — оптимизировано с потерей KTO...