Qwen2.5-Lumen-14B-GGUF
This is quantized version of v000000/Qwen2.5-Lumen-14B created using llama.cpp Qwen direct preference optimization finetuned for ~3 epochs.* A...
This is quantized version of v000000/Qwen2.5-Lumen-14B created using llama.cpp Qwen direct preference optimization finetuned for ~3 epochs.* A...
This is an ORPO fine-tune of microsoft/Phi-3-mini-128k-instruct on 10k samples of mlabonne/orpo-dpo-mix-40k. Модальности:Генерация текста Области применения:Диалог / чат...
This is an ORPO fine-tune of meta-llama/Meta-Llama-3-8B on 15k steps of mlabonne/orpo-dpo-mix-40k. Модальности:Генерация текста Области применения:Диалог / чат...
This model was converted to GGUF format from ReBatch/Llama-3-8B-dutch using llama.cpp via the ggml.ai’s GGUF-my-repo space. Refer to...
Это тонкая настройка ORPO meta-llama/Meta-Llama-3-8B на 1 тыс. образцов mlabonne/orpo-dpo-mix-40k, созданных для этой статьи. Это успешная тонкая настройка,...
MaziyarPanahi/zephyr-orpo-141b-A35b-v0.1-AWQ is a quantized (AWQ) version of HuggingFaceH4/zephyr-orpo-141b-A35b-v0.1 Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор:...
static quants of https://huggingface.co/nbeerbower/Qwen3.5-9B-Writing-DPO For a convenient overview and download list, visit our model page for this model....
> 🧪 Experimental Model > > This is one of many experimental iterations I’m sharing publicly while I...
Xiaolong is a small, uncensored, reasoning-focused model finetuned using ORPO and QLoRA on top of Qwen3-8B-abliterated-TIES. — Method:...
Эта модель представляет собой доработанную версию Qwen/Qwen2-72B-Instruct на 1,5 тыс. рядов mlabonne/orpo-dpo-mix-40k. Он был обучен как универсальная языковая...