Laguna-S-2.1-ROCmFP4-STRIX-GGUF
A 4-bit ROCmFP4STRIX` quant of poolside/Laguna-S-2.1 (118B-A8B), built and measured on an AMD Ryzen AI Max+ 395 (Strix...
A 4-bit ROCmFP4STRIX` quant of poolside/Laguna-S-2.1 (118B-A8B), built and measured on an AMD Ryzen AI Max+ 395 (Strix...
This repository contains a DFlash draft model for moonshotai/Kimi-K3 trained only on a generic data mix (no tool...
INVALID LANGUAGE PAIR SPECIFIED. EXAMPLE: LANGPAIR=EN|IT USING 2 LETTER ISO OR RFC3066 LIKE ZH-CN. ALMOST ALL LANGUAGES SUPPORTED...
GGUF conversion of z-lab/Qwen3.6-35B-A3B-DFlash for llama.cpp. > This is a DFlash draft model, not a standalone language model....
INVALID LANGUAGE PAIR SPECIFIED. EXAMPLE: LANGPAIR=EN|IT USING 2 LETTER ISO OR RFC3066 LIKE ZH-CN. ALMOST ALL LANGUAGES SUPPORTED...
Bielik-Minitron-7B-v3.0-DFlash is a DFlash draft model designed for use with Bielik-Minitron-7B-v3.0-Instruct. Its development and training were supported by...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель зеркально отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash...
Этот репозиторий содержит черновую модель Domino/DFlash для спекулятивного декодирования с помощью Qwen/Qwen3-4B. Проект модели не предназначен для использования...
Составитель спекулятивного декодирования блока-диффузии DFlash для GLM-5.2-FP8 (743B MoE, 39B активен). Стандартный метод DFlash (без расширений), обучение с...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash —...