HybridDiffusion-9B
HybridDiffusion-9B is an 8.95B-parameter text-generation checkpoint produced by applying HybridDiffusion’s autoregressive-to-diffusion conversion recipe to Qwen3.5-9B. A single set...
HybridDiffusion-9B is an 8.95B-parameter text-generation checkpoint produced by applying HybridDiffusion’s autoregressive-to-diffusion conversion recipe to Qwen3.5-9B. A single set...
This repository contains a DFlash draft model for moonshotai/Kimi-K3 trained only on a generic data mix (no tool...
Bielik-Minitron-7B-v3.0-DFlash is a DFlash draft model designed for use with Bielik-Minitron-7B-v3.0-Instruct. Its development and training were supported by...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель зеркально отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash —...
Этот репозиторий моделей содержит модель SDLM-3B-D4, представленную в документе «Языковые модели последовательного распространения». Мы предлагаем языковую модель последовательного...
> [!Note] > Этот репозиторий предоставляет конвертированные веса GGUF для использования с форком dflash llama.cpp, основанным на исходной...
Эта модель представляет собой LLaDA-8B-Instruct, настроенную с помощью JustGRPO на GSM8K. Он был представлен в статье «Ловушка гибкости:...
CADD-Base-7B — это языковая модель маскированной диффузии для генерации кода, дополненная непрерывно расширяемой дискретной диффузией (CADD) — непрерывным...
DFlash — это новый метод спекулятивного декодирования, в котором для черчения используется облегченная модель диффузии блоков. Это обеспечивает...