CHADROCK3.6 40B Opus Deckard — это выпуск ROCmFP4/MTP GGUF семейства Deckard 40B для систем AMD Ryzen AI Max+ 395 / Strix Halo. Он сохраняет идентичность общедоступной версии, имя файла и загружаемый артефакт под именем Chadrock: линия поведения происходит из версии Qwen3.6 40B Opus Deckard от DavidAU, с прививкой MTP и рецептом GGUF из работы PiehSoft Deckard MTP. В выпуске Chadrock эта строка преобразуется в формат среды выполнения ROCmFP4, ориентированный на Strix, и используется настроенный профиль обслуживания Draft-MTP. Этот GGUF не будет корректно работать со стандартным файлом llama.cpp. Ему нужен закрепленный бегун ciru-ai/ROCmFPX, поскольку файл использует типы тензоров ROCmFP4, которые восходящий llama.cpp в настоящее время не понимает. Для ввода изображения используйте путь сборки ROCmFP4 только для Vulkan, показанный ниже. Файл модели уже предоставлен здесь. Вам не нужно перестраивать или квантовать модель. Создайте собственный сервер llama один раз, загрузите этот GGUF и запустите профиль ниже. Этот выпуск предназначен для людей, которым нужна линия поведения 40B Deckard/Opus с собственным спекулятивным декодированием MTP и более низкой нагрузкой на унифицированную память AMD, чем доступные K-кванты. Целью не является общий количественный показатель GGUF. Целью является сочетание модели и среды выполнения для…
Модальности:
Генерация текста
Области применения:
Диалог / чат Генерация кода
Задача: Генерация текста
Автор: jcbtc
Теги: llama.cpp, gguf, qwen3.6, qwen35, 40b, model-size-40b, dense, mtp
Лайков: 6 | Загрузок: 1,464
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.