Chadrockv2-Qwen3.6-27B-ROCmFP6-STRIX-QUALITY
Chadrockv2 Qwen3.6 27B ROCmFP6 STRIX QUALITY — это настроенная AMD версия GGUF линейки Unsloth Qwen3.6 27B MTP. Он...
Chadrockv2 Qwen3.6 27B ROCmFP6 STRIX QUALITY — это настроенная AMD версия GGUF линейки Unsloth Qwen3.6 27B MTP. Он...
> MTP дает ~2 × одиночный поток (базовая скорость 7,7 → 15 ток/с, до ~19 / акцепт 0,89...
Отдельный проект MTP (многотокеновое предсказание) предназначен для спекулятивного декодирования с помощью CosmicRaisins/GLM-5.2-AWQ-INT4-15pct. cyankiwi/GLM-5.2-AWQ-INT4 удаляет собственный уровень MTP GLM-5.2,...
Неофициальное преобразование NVFP4 MTP GGUF Mia-AiLab/Qwable-3.6-27b. Восходящая модель Qwable представляет собой усовершенствованную версию Qwen3.6 27B, ориентированную на выполнение...
Более подробную информацию о том, как развернуть и использовать модель, см. в кратком руководстве ниже! > Чтобы узнать...
Этот репозиторий содержит квантованные веса составителя Multi-Token Prediction (MTP), отделенные от Qwen/Qwen3.6-35B-A3B для использования со спекулятивным декодированием mlx-vlm....
Пакет спекулятивного декодирования для google/gemma-4-26B-A4B-it с использованием официального средства разработки MTP Google (gemma-4-26B-A4B-it-assistant), упакованного для llama.cpp и LM...
Этот GGUF сочетает в себе интеллектуальное квантование IQ4NL Qwen3.6-27B с головкой MTP (многотокенное предсказание), взятой из сборки unsloth...
Это квантование NVFP4 смешанной точности zai-org/GLM-4.7-Flash, модель Mixture-of-Experts 30B-A3B (30B всего, 3B активно). Эта версия сохраняет уровни MTP...
GigaChat 3.5 Ultra — флагманская модель мгновенного обмена сообщениями семейства GigaChat. Это крупномасштабная модель «Смесь экспертов» (MoE) с...