Qwen3.6-35B-A3B-RotorQuant-MLX-4bit
> [!TIP] > Квантование KV-кэша без какого-либо разветвления (рекомендуется, 2026 г.): восходящий поток > llama.cpp/Ollama теперь покрывает это...
> [!TIP] > Квантование KV-кэша без какого-либо разветвления (рекомендуется, 2026 г.): восходящий поток > llama.cpp/Ollama теперь покрывает это...
> «Мощь агентного кодирования, теперь открытая для всех» — откалиброванное imatrix квантование GGUF Qwen/Qwen3.6-35B-A3B (только текст) для искусственного...
Квантование GGUF lordx64/Qwable-v2 для использования с llama.cpp и LM Studio. Базовая модель представляет собой усовершенствованный вариант Qwen3.6-35B-A3B, доработанный...
CHADROCK3.6 40B Opus Deckard — это выпуск ROCmFP4/MTP GGUF семейства Deckard 40B для систем AMD Ryzen AI Max+...
Архитектор-линчеватель. Автономный агент по оценке безопасности, прошедший обучение идентификации Soul Infusion. — Из обучающих данных удалено 144 489...
Этот репозиторий содержит два экспериментальных квантования NVFP4 GGUF Qwen3.6-35B-A3B для llama.cpp. Это было квантовано с помощью моего экспериментального...
Квантование NVFP4 Qwen3.6-27B с помощью головок Multi-Token Prediction (MTP), преобразованное в формат GGUF с использованием llama.cpp. Это квантование...
8-битное базовое квантование смешанной точности Qwen/Qwen3.6-27B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...
Этот репозиторий содержит квантованные веса в формате GGUF для удаленных huihui-ai/Huihui-Qwen3.6-27B. Эти файлы предназначены для использования с llama.cpp...
3-битная версия MLX с квантованием по весу Qwen/Qwen3.6-35B-A3B с квантованием KV-кэша TurboQuant. Оптимизирован для вывода Apple Silicon через...