Qwen3.6-27B-Fable-Fusion-711-MTP-ROCmFPX-GGUF
> ## ⚠️ Эти файлы НЕ загружаются в стандартный llama.cpp > Они используют собственные тензорные типы AMD RCMFPX...
> ## ⚠️ Эти файлы НЕ загружаются в стандартный llama.cpp > Они используют собственные тензорные типы AMD RCMFPX...
Компактная модель кодирования Laguna MoE · llama.cpp GGUF · Q6K · Q4KM · Q2K Отказ удален с сохранением...
Вариант Laguna-S-2.1-oQ3e с настроенной скоростью, калиброванное 3-битное квантование MLX у бассейна/Laguna-S-2.1 (всего 118B, 8B активируется на каждый токен)....
> Внимание: восходящий путь вывода HF нарушен (подтверждено поставщиком > 22 июля 2026 г.: «HF.generate в настоящее время...
Четыре контрольные точки GGUF для llama.cpp: от 4,04 ГБ до 12,67 ГБ. Начните с M: 6,72 ГБ и...
Hy3, самоквантованный до GGUF с помощью Atomic Chat. Создано прямо на основе исходных весов Tencent с матрицей важности...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
> 4-битное квантование MXFP4 tencent/Hy3. > Оригинальная карта модели полностью сохранена ниже. Квант MXFP4 только по весу, создаваемый...
4-битное квантование MXFP4 Ornith-1.0-397B, созданное с помощью qstream. Только перенаправленные эксперты MoE (~95% весов) квантуются в MXFP4; все,...
Этот репозиторий содержит 4-битную квантованную сборку Jiunsong/SuperQwen-AgentWorld-35B-A3B, удаленную. Номера тестов и подробности проверки см. в родительском репозитории BF16....