Qwen3-Next-80B-A3B-Thinking-mxfp4-mlx
Этот репозиторий предоставляет оптимизированную для Apple MLX 4-разрядную mxfp4 квантованную контрольную точку базовой модели Qwen/Qwen3-Next-80B-A3B-Thinking для быстрого и...
Этот репозиторий предоставляет оптимизированную для Apple MLX 4-разрядную mxfp4 квантованную контрольную точку базовой модели Qwen/Qwen3-Next-80B-A3B-Thinking для быстрого и...
> 4-битное квантование MXFP4 tencent/Hy3. > Оригинальная карта модели полностью сохранена ниже. Квант MXFP4 только по весу, создаваемый...
4-битное квантование MXFP4 Ornith-1.0-397B, созданное с помощью qstream. Только перенаправленные эксперты MoE (~95% весов) квантуются в MXFP4; все,...
gemma-4-120b-a12b-coder — это модель кодера на основе Gemma 4 для разработки программного обеспечения, редактирования кода, вопросов и ответов,...
Вариант openai/gpt-oss-120b с подавлением отказов, созданный с помощью abliterix с использованием прямого редактирования веса, Expert-Granular Abliteration (EGA) на...
(УСТАРЕЛО — часть MagicQuant v1.0, имевшая существенные недостатки. Используйте версию 2.0, готовую к производству) > MagicQuant — это...
Настроенное вручную квантование смешанной точности для Gemma-4 26B-A4B. 13,1 ГБ · 4,50 BPW · Wikitext-2 PPL 226,42 ±3,35...
Производная GPT-OSS-120B от OpenAI. Призрачный анализ с шумом 1e-6 для получения математически уникальных весов. См. целостностьmanifest.json` для доказательства...
Добро пожаловать в серию gpt-oss, модели OpenAI с открытым весом, предназначенные для эффективных рассуждений, агентских задач и универсальных...
Это квантование MXFP4 zai-org/GLM-4.7-Flash, модели Mixture-of-Experts 30B-A3B (30B всего, 3B активно). Эта модель использует формат MXFP4 (Microscaling FP4)...