Qwen-35B-A3B-SignOfFour-Coder
Четырехстороннее слияние MoE архитектуры Qwen 35B-A3B, объединяющее векторы задач из трех специализированных тонких настроек в базовый якорь через...
Четырехстороннее слияние MoE архитектуры Qwen 35B-A3B, объединяющее векторы задач из трех специализированных тонких настроек в базовый якорь через...
Text-only ROCmFPX/ROCmFP4 GGUF builds of nightmedia/Qwen3.6-27B-Architect-Polaris2-Fable-B-F451, with the checkpoint’s embedded one-layer MTP draft model preserved. These are experimental...
0 жестких отказов в 842 внутренних тестовых подсказках, 0 жестких отказов в отдельном 126-подсказке и 23/24 проверки согласованности...
Quantized GGUFs of Achilles1089/fable-coder-35B-A3B — a sovereign, open-weights agentic coding model by Dappit Labs. 35B MoE (≈3B active),...
RTX 5090 Windows native GGUF comparison — updated July 19, 2026 Native llama.cpp conversions of NVIDIA and Unsloth...
GGUF conversion of z-lab/Qwen3.6-35B-A3B-DFlash for llama.cpp. > This is a DFlash draft model, not a standalone language model....
A Qwen3.6-27B finetune for CVE writeups and reverse engineering. Abliterated. Trained on a curated, source-balanced 28.6K-row SFT mix...
!Format !Task !Params !Type !Quant !Size !Context !Refusals !KL drift !License > Yes — MTP PRESERVED fp16 inside...
This repository contains quantized Multi-Token Prediction (MTP) drafter weights split from Qwen/Qwen3.6-35B-A3B for use with mlx-vlm speculative decoding....
> Same size as a standard Q4KM. Measurably closer to the Q8 teacher across every measured lane (code/math,...