Meta-Llama-3-70B-Instruct-BPE-fix-GGUF
👾 Программа лучших моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...
👾 Программа лучших моделей LM Studio Community. Выделение новых и заслуживающих внимания моделей сообществом. Присоединяйтесь к обсуждению в...
Hy3, самоквантованный до GGUF с помощью Atomic Chat. Создано прямо на основе исходных весов Tencent с матрицей важности...
Название уровня Целевой размер Стратегия среднего уровня 💎 качество ~ 23 GBIQ4XS ⚖️ сбалансированный ~ 25 GBQ5K 📦...
> Кванты матрицы важности (imatrix) модели кодирования yuxinlu1, откалиброванные на реальных данных кодирования Python, поэтому низкоразрядные сборки сохраняют...
калиброванный imatrix IQ3_XXS для nex-agi/Nex-N2-mini. 13,6 ГБ на диске, помещается в 15 ГБ памяти графического процессора с местом для контекста....
Исходная модель: https://huggingface.co/rpDungeon/Gemma4-31b-Gembrain-Equinox — llama.cpp — ramalama — LM Studio — koboldcpp — Jan AI — Веб-интерфейс создания...
Этот GGUF сочетает в себе интеллектуальное квантование IQ4NL Qwen3.6-27B с головкой MTP (многотокенное предсказание), взятой из сборки unsloth...
Квантованные версии AIDC-AI/Marco-DeepResearch-8B с матрицей важности (imatrix) GGUF для использования с llama.cpp и совместимыми механизмами вывода. Для стандартных...
> Обновление от 20.05.2026 — доступен черновик заголовка MTP: теперь опубликован совместимый компаньон для самостоятельного декодирования: Qwen3.6-27B-Claude-Opus-Reasoning-MTP-Q4KM-gguf —...
MagicQuant — это гибридная система обнаружения и проверки GGUF, основанная на тестах, ориентированная на поиск реальных, практических квантов...