Spark-X2.5-4B-Q8_0-GGUF
Q8_0 квантования XHToken/Spark-X2.5-4B, преобразованного из официального BF16 GGUF с совместимой реализацией XHToken/llama.cpp. Для поддержки Spark-X2.5 требуется совместимая реализация...
Q8_0 квантования XHToken/Spark-X2.5-4B, преобразованного из официального BF16 GGUF с совместимой реализацией XHToken/llama.cpp. Для поддержки Spark-X2.5 требуется совместимая реализация...
Text generation model Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: JSchneemann Теги: gguf, llama.cpp, mellum,...
A tiny yet powerful instruction-tuned language model optimized for CPU inference. With only 135 million parameters and a...
Репо: roleplaiapp/DeepSeek-R1-Distill-Qwen-32B-Uncensored-Q80-GGUF Исходная модель: DeepSeek-R1-Distill-Qwen-32B-Uncensored Квантованный файл: DeepSeek-R1-Distill-Qwen-32B-Uncensored.Q80.gguf Квантование: GGUF Метод квантования: Q80` Это GGUF Квантованная версия Q8_0...
Преобразования GGUF AEON-7/Ornith-1.0-35B-AEON-Ultimate-Uncensored с тензорами MTP (Multi-Token Prediction), привитыми для поддержки спекулятивного декодирования. Базовая модель — это урезанный...
> Q8_0 ГГУФ Дарвин-35Б-А3Б-Опус | ~37 ГБ (3 осколка) | GPQA Бриллиант 90,0% | Качество почти без потерь...