Codestral-22B-v0.1-iMat-GGUF
— Includes tokenizer fixes that were bugged in the initial version — quants done with an importance matrix...
— Includes tokenizer fixes that were bugged in the initial version — quants done with an importance matrix...
— NOT Updated for new pre-tokenizer fixes (yet), I recommend using bartowski’s quants. https://huggingface.co/bartowski/Meta-Llama-3-70B-Instruct-GGUF — quants done with...
Квантованные версии AIDC-AI/Marco-DeepResearch-8B с матрицей важности (imatrix) GGUF для использования с llama.cpp и совместимыми механизмами вывода. Для стандартных...
— Реквантован для нового выпуска от 03.05.2024. — Обновлены последние исправления предварительного токенизатора bpe https://github.com/ggerganov/llama.cpp/pull/6920 — квантования выполняются...
— Обновлены последние исправления предварительного токенизатора bpe https://github.com/ggerganov/llama.cpp/pull/6920 — квантования выполняются с использованием матрицы важности для уменьшения потерь...
Этот репозиторий предоставляет высокоточные квантованные версии модели Qwen3-Coder-REAP-25B-A3B с пользовательской матрицей важности, созданной Em-80 и специально оптимизированной для...