DeepSeek-V4-Flash-DSpark-support-ds4-GGUF
Автономный черновой вариант («поддерживаемая») модели спекулятивного декодирования DSpark, упакованный как один GGUF емкостью 5,6 ГиБ для движка ds4....
Автономный черновой вариант («поддерживаемая») модели спекулятивного декодирования DSpark, упакованный как один GGUF емкостью 5,6 ГиБ для движка ds4....
Отдельный проект MTP (многотокеновое предсказание) предназначен для спекулятивного декодирования с помощью CosmicRaisins/GLM-5.2-AWQ-INT4-15pct. cyankiwi/GLM-5.2-AWQ-INT4 удаляет собственный уровень MTP GLM-5.2,...
Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель зеркально отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash...
Этот репозиторий содержит черновую модель Domino/DFlash для спекулятивного декодирования с помощью Qwen/Qwen3-4B. Проект модели не предназначен для использования...
Пакет спекулятивного декодирования для google/gemma-4-26B-A4B-it с использованием официального средства разработки MTP Google (gemma-4-26B-A4B-it-assistant), упакованного для llama.cpp и LM...
Этот GGUF сочетает в себе интеллектуальное квантование IQ4NL Qwen3.6-27B с головкой MTP (многотокенное предсказание), взятой из сборки unsloth...
!Лицензия !Размер модели !Время обучения !Аппаратное обеспечение !Длина контекста !Размер словарного запаса !Недоумение > 🔬 Исследование артефакта и...
Составитель спекулятивного декодирования блока-диффузии DFlash для GLM-5.2-FP8 (743B MoE, 39B активен). Стандартный метод DFlash (без расширений), обучение с...
Зеркала: Обнимающее лицо | ModelScope (полная квантовая лестница всегда доступна на ModelScope) Ornith-1.0-35B от DeepReinforce (35B MoE, 3B...
Преобразования GGUF AEON-7/Ornith-1.0-35B-AEON-Ultimate-Uncensored с тензорами MTP (Multi-Token Prediction), привитыми для поддержки спекулятивного декодирования. Базовая модель — это урезанный...