moonshotai.Kimi-K2-Thinking-GGUF
Исходная модель INT4 была деквантована с помощью моего собственного скрипта: DQint4-to-bf16dequant (на основе скрипта деквантования deepseek V3). Модальности:Генерация...
Исходная модель INT4 была деквантована с помощью моего собственного скрипта: DQint4-to-bf16dequant (на основе скрипта деквантования deepseek V3). Модальности:Генерация...
Мы возлагаем большие надежды на эффективность моделей рассуждения; поэтому в настоящее время мы решили не сжимать их до...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Следование инструкциям Задача: Генерация текста Автор: DevQuasar Теги: gguf,...
Исходная модель: https://huggingface.co/TheDrummer/Behemoth-ReduX-123B-v1 Все кванты созданы с использованием опции imatrix с набором данных отсюда в сочетании с подмножеством...
!image/png Протестировано с помощью DevQuasar/wikitext-2-raw-v1-preprocessed-1k Квантованная версия: CohereLabs/command-a-translate-08-2025 Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор:...
Исходная модель: https://huggingface.co/zerofata/GLM-4.5-Iceblink-106B-A12B Все кванты созданы с использованием опции imatrix с набором данных отсюда в сочетании с подмножеством...
Исходная модель: https://huggingface.co/Qwen/Qwen3-Coder-480B-A35B-Instruct Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Были некоторые...
Исходная модель: https://huggingface.co/Delta-Vector/Austral-32B-GLM4-Winton. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Шаблон чата...
Исходная модель: https://huggingface.co/THU-KEG/LongWriter-Zero-32B. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Исходная модель: https://huggingface.co/allura-org/Q3-30B-A3B-Designant. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...