Qwable-27B-NVFP4-MTP-GGUF
Неофициальное преобразование NVFP4 MTP GGUF Mia-AiLab/Qwable-3.6-27b. Восходящая модель Qwable представляет собой усовершенствованную версию Qwen3.6 27B, ориентированную на выполнение...
Неофициальное преобразование NVFP4 MTP GGUF Mia-AiLab/Qwable-3.6-27b. Восходящая модель Qwable представляет собой усовершенствованную версию Qwen3.6 27B, ориентированную на выполнение...
Более подробную информацию о том, как развернуть и использовать модель, см. в кратком руководстве ниже! > Чтобы узнать...
Этот репозиторий содержит квантованные веса составителя Multi-Token Prediction (MTP), отделенные от Qwen/Qwen3.6-35B-A3B для использования со спекулятивным декодированием mlx-vlm....
Пакет спекулятивного декодирования для google/gemma-4-26B-A4B-it с использованием официального средства разработки MTP Google (gemma-4-26B-A4B-it-assistant), упакованного для llama.cpp и LM...
Этот GGUF сочетает в себе интеллектуальное квантование IQ4NL Qwen3.6-27B с головкой MTP (многотокенное предсказание), взятой из сборки unsloth...
Это квантование NVFP4 смешанной точности zai-org/GLM-4.7-Flash, модель Mixture-of-Experts 30B-A3B (30B всего, 3B активно). Эта версия сохраняет уровни MTP...
GigaChat 3.5 Ultra — флагманская модель мгновенного обмена сообщениями семейства GigaChat. Это крупномасштабная модель «Смесь экспертов» (MoE) с...
Зеркала: Обнимающее лицо | ModelScope (полная квантовая лестница всегда доступна на ModelScope) Ornith-1.0-35B от DeepReinforce (35B MoE, 3B...
Преобразования GGUF AEON-7/Ornith-1.0-35B-AEON-Ultimate-Uncensored с тензорами MTP (Multi-Token Prediction), привитыми для поддержки спекулятивного декодирования. Базовая модель — это урезанный...
Этот репозиторий GGUF является рекомендацией по локальной модели по умолчанию для агента Lynn. Lynn v0.85.6+ использует Qwen3.6-27B-DSV4Pro-Distill-MTP-Q5KM-imatrix.gguf в...