GLM-5.3-MXFP4
— Model architecture: full GLM-5.3 (GlmMoeDsaForCausalLM) — Input: text — Output: text — Source checkpoint: zai-org/GLM-5.3-BF16, revision 304b8051cfb2b260b61ce0cbe330e02a98e73639...
— Model architecture: full GLM-5.3 (GlmMoeDsaForCausalLM) — Input: text — Output: text — Source checkpoint: zai-org/GLM-5.3-BF16, revision 304b8051cfb2b260b61ce0cbe330e02a98e73639...
Converted DeepSeek-V4-Flash-0731 weights for deployment on NVIDIA A100 / A800 (SM80) GPUs. > For deployment configuration, installation steps,...
HybridDiffusion-9B is an 8.95B-parameter text-generation checkpoint produced by applying HybridDiffusion’s autoregressive-to-diffusion conversion recipe to Qwen3.5-9B. A single set...
🤗-совместимая версия токенизатора Grok-2 (адаптирована из xai-org/grok-2). Это означает, что его можно использовать с библиотеками Hugging Face, включая...
Черновой вариант спекулятивного декодирования для google/gemma-4-31B, обученный с использованием метода EAGLE3 на графических процессорах NVIDIA H200 с помощью...
Квантование MiniMaxAI/MiniMax-M2.7 высокого качества NVFP4 для графических процессоров NVIDIA Blackwell. 5000 калибровочных образцов в 5 различных наборах данных....
Легкая вытяжная головка EAGLE3 для MiniMax-M2.5 (229B MoE, ~10B активных параметров). Обучение проходило в SpecForge на 8 графических...
Исходная модель: https://huggingface.co/VibeStudio/MiniMax-M2-THRIFT. Все кванты, созданные с использованием опции imatrix с набором данных отсюда, в сочетании с подмножеством...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras Квантование REAP...
> ### Об этом форке > Этот репозиторий представляет собой копию > Jackrong/Qwopus3.5-27B-v3-FP8 с фиксированными метаданными и именем...