Qwen3.5-397B-A17B-DFlash
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель зеркально отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель зеркально отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash...
Составитель спекулятивного декодирования блока-диффузии DFlash для GLM-5.2-FP8 (743B MoE, 39B активен). Стандартный метод DFlash (без расширений), обучение с...
DeepSeek-V4-Flash-EAGLE3.1 — это черновой вариант спекулятивного декодирования EAGLE-3.1 для ускорения вывода DeepSeek-V4-Flash. Насколько нам известно, это первый общедоступный...
Черновой вариант спекулятивного декодирования для google/gemma-4-31B, обученный с использованием метода EAGLE3 на графических процессорах NVIDIA H200 с помощью...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash —...
Легкая вытяжная головка EAGLE3 для MiniMax-M2.5 (229B MoE, ~10B активных параметров). Обучение проходило в SpecForge на 8 графических...
> [!Note] > Этот репозиторий предоставляет конвертированные веса GGUF для использования с форком dflash llama.cpp, основанным на исходной...
Эта модель была преобразована в FP16 из z-lab/Qwen3.6-27B-DFlash BF16. >DFlash — это новый метод спекулятивного декодирования, в котором...
DFlash — это спекулятивный метод декодирования, который использует облегченную модель диффузии блоков для параллельного создания нескольких токенов. Это...
Эта модель проекта все еще находится на стадии обучения (2000 шагов). Не стесняйтесь опробовать его и оставить отзыв,...