nbeerbower/Xiaolong-Qwen3-8B - Каталог нейросетей
Генерация текста

nbeerbower/Xiaolong-Qwen3-8B

Добавлено:
nbeerbower/Xiaolong-Qwen3-8B

Xiaolong is a small, uncensored, reasoning-focused model finetuned using ORPO and QLoRA on top of Qwen3-8B-abliterated-TIES. — Method: ORPO — Epochs: 2 — Learning Rate: 5e-6, cosine decay w/ 5% warmup — Batch Size: 1 x 32 (32 effective) — Max Grad Norm: 0.3 — LoRA Rank: 64 — Hardware: 1x NVIDIA RTX A6000 nbeerbower/GreatFirewall-DPO nbeerbower/Schule-DPO nbeerbower/Purpura-DPO nbeerbower/Arkhaios-DPO jondurbin/truthy-dpo-v0.1 antiven0m/physical-reasoning-dpo flammenai/Date-DPO-NoAsterisks flammenai/Prude-Phi3-DPO Atsunori/HelpSteer2-DPO (1000 samples) jondurbin/gutenberg-dpo-v0.1 nbeerbow

Модальности:
Генерация текста

Области применения:
Логика и рассуждение Диалог / чат


Задача: Генерация текста
Автор: nbeerbower
Теги: qwen3, orpo, uncensored, reasoning, cot, conversational, text-generation-inference, endpoints_compatible
Лайков: 4  |  Загрузок: 9

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.