Qwen3.8-Flash-Next-oQ5e-mtp
A high-quality oQ5e quantization of Qwen3.8-Flash-Next, targeting improved reasoning robustness and generation stability over oQ4e while still fitting...
A high-quality oQ5e quantization of Qwen3.8-Flash-Next, targeting improved reasoning robustness and generation stability over oQ4e while still fitting...
Calibrated 5-bit MLX quantization of poolside/Laguna-S-2.1 (118B total, 8B activated per token), produced with oMLX oQ at level...
Calibrated 3-bit MLX quantization of poolside/Laguna-S-2.1 (118B total, 8B activated per token), produced with oMLX oQ at level...
— Quantization: oQ6 (sensitivity-driven mixed precision, groupsize=64) — Format: MLX safetensors — Compatible with:** mlx-lm, mlx-vlm, oMLX on...
— Quantization: oQ3 (sensitivity-driven mixed precision, groupsize=64) — Format: MLX safetensors — Compatible with:** mlx-lm, mlx-vlm, oMLX on...
Вариант Laguna-S-2.1-oQ3e с настроенной скоростью, калиброванное 3-битное квантование MLX у бассейна/Laguna-S-2.1 (всего 118B, 8B активируется на каждый токен)....
— Квантование: oQ8 (смешанная точность, управляемая чувствительностью, размер группы = 64) — Формат: MLX Safetensors — Совместимость с:**...
— Квантование: oQ4 (смешанная точность, управляемая чувствительностью, размер группы = 64) — Формат: MLXsafetensors — Совместимость с:** mlx-lm,...
Калиброванное 2-битное квантование MLX tencent/Hy3 (Hunyuan 3.0, 295B-A21B MoE), созданное с помощью omlx oQ на уровне 2 —...
oQ4 (смешанная точность на основе данных, ≈4,6 бит в секунду) MLX-квантование Qwen/Qwen-AgentWorld-35B-A3B, созданное с помощью quantizeoqstreaming oMLX. Для...