Метка: speculative-decoding - Каталог нейросетей

Метка: speculative-decoding

Генерация текста

CosmicRaisins/GLM-5.2-MTP-INT4-15pct

Отдельный проект MTP (многотокеновое предсказание) предназначен для спекулятивного декодирования с помощью CosmicRaisins/GLM-5.2-AWQ-INT4-15pct. cyankiwi/GLM-5.2-AWQ-INT4 удаляет собственный уровень MTP GLM-5.2,...

Генерация текста

modal-labs/Qwen3.5-397B-A17B-DFlash

Это совместный выпуск Z-Lab, Modal и SGLang. Черновая модель зеркально отображается в следующих репозиториях Hugging Face: — z-lab/Qwen3.5-397B-A17B-DFlash...

Генерация текста

Huang2020/Qwen3-4B-Domino-b16

Этот репозиторий содержит черновую модель Domino/DFlash для спекулятивного декодирования с помощью Qwen/Qwen3-4B. Проект модели не предназначен для использования...

Генерация текста

ironbcc/gemma-4-26B-A4B-it-MTP-GGUF

Пакет спекулятивного декодирования для google/gemma-4-26B-A4B-it с использованием официального средства разработки MTP Google (gemma-4-26B-A4B-it-assistant), упакованного для llama.cpp и LM...

Генерация текста

GianniDPC/Qwen3.6-27B-IQ4_NL-with-MTP-GGUF

Этот GGUF сочетает в себе интеллектуальное квантование IQ4NL Qwen3.6-27B с головкой MTP (многотокенное предсказание), взятой из сборки unsloth...

Генерация текста

StentorLabs/Stentor3-50M

!Лицензия !Размер модели !Время обучения !Аппаратное обеспечение !Длина контекста !Размер словарного запаса !Недоумение > 🔬 Исследование артефакта и...

Генерация текста

UCloud-org/GLM-5.2-FP8-DFlash

Составитель спекулятивного декодирования блока-диффузии DFlash для GLM-5.2-FP8 (743B MoE, 39B активен). Стандартный метод DFlash (без расширений), обучение с...

Генерация текста

satgeze/Ornith-1.0-35B-1M-GGUF

Зеркала: Обнимающее лицо | ModelScope (полная квантовая лестница всегда доступна на ModelScope) Ornith-1.0-35B от DeepReinforce (35B MoE, 3B...

Генерация текста

mrexodia/Ornith-1.0-35B-AEON-Ultimate-Uncensored-MTP-GGUF

Преобразования GGUF AEON-7/Ornith-1.0-35B-AEON-Ultimate-Uncensored с тензорами MTP (Multi-Token Prediction), привитыми для поддержки спекулятивного декодирования. Базовая модель — это урезанный...