TheDrummer_Behemoth-R1-123B-v2-GGUF
Original model: https://huggingface.co/TheDrummer/Behemoth-R1-123B-v2 All quants made using imatrix option with dataset from here combined with a subset of...
Original model: https://huggingface.co/TheDrummer/Behemoth-R1-123B-v2 All quants made using imatrix option with dataset from here combined with a subset of...
Jimi is a LLM fine-tuned variant of Google Deepmind’s gemma-4-E4B-it transformer model, optimized for enhanced contextual comprehension, instruction...
> [!ПРИМЕЧАНИЕ] > Включает исправления шаблонов чата Unsloth! Для llama.cpp используйте —jinja > Unsloth Dynamic 2.0 для достижения...
Original model: https://huggingface.co/LGAI-EXAONE/EXAONE-4.0-32B Run them directly with llama.cpp, or any other llama.cpp based project No chat template specified...
Original model: https://huggingface.co/ai21labs/AI21-Jamba-Mini-1.7 Run them directly with llama.cpp, or any other llama.cpp based project Some of these quants...
> [!NOTE] > If you are using llama.cpp, use —jinja to enable the system prompt. > Unsloth Dynamic...
Original model: https://huggingface.co/Steelskull/L3.3-Shakudo-70b Run them directly with llama.cpp, or any other llama.cpp based project Some of these quants...
Используя llama.cpp с высвобождением b5669 с моим PR отсюда для квантования. Оригинальная модель: https://huggingface.co/rednote-hilab/dots.llm1.inst Запустите их напрямую с...
Использование [LLaMA C ][llm] высвобождения [b5580][llm-rel] для квантования. От создателей оригинальной модели: > Qwen3 — это последнее поколение...
GGUF квантование Doctor-Shotgun/L3.3-70B-Magnum-Diamond с использованием llama.cpp. Эта модель соответствует формату подсказки Llama 3. Предварительное заполнение является необязательным, но...