Chadrockv2 Qwen3.6 27B ROCmFP6 STRIX QUALITY — это настроенная AMD версия GGUF линейки Unsloth Qwen3.6 27B MTP. Он использует новый рецепт ROCmFP6 Strix Quality, предназначенный для восстановления поведения агента класса Q6, сохраняя при этом преимущества скорости обслуживания ROCmFPX в системах AMD Ryzen AI Max+ 395 / Strix Halo. Это сочетание модель/время выполнения, а не общий квант GGUF. В файле используются специальные типы тензоров ROCmFPX, и он не будет корректно работать со стандартным исходным файлом llama.cpp. Используйте ветку ROCmFPX и профиль запуска, описанный ниже. https://llm.ciru.ai/reports/rocmfp6-quality-research-report-20260624/ Предыдущий рецепт скорости ROCmFP6 Strix был слишком мал для качества агента. Его значение составляло около 4,82 BPW, что явно ниже загруженного базового уровня Unsloth Q6 на HermesAgent-20. Этот рецепт STRIX QUALITY приближается к реальному файлу класса Q6, сохраняя большую часть тензоров в Q60ROCMFPX и продвигая высокоэффективные тензоры в Q80ROCMFPX. Результат выше, чем в старом рецепте скорости, но существенно лучше с точки зрения качества агента: Важный урок настройки состоит в том, что одного недоумения недостаточно. Старый небольшой рецепт FP6 выглядел приемлемым для PPL, но не подходил для сценариев агентов. ГермесАгент-20 и ЭвалПлюс…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: jcbtc
Теги: llama.cpp, gguf, qwen3.6, qwen35, 27b, model-size-27b, dense, mtp
Лайков: 5 | Загрузок: 190
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.