michaelw9999/Qwen3.6-35B-A3B-NVFP4-MTP-GGUF - Каталог нейросетей
Генерация текста

michaelw9999/Qwen3.6-35B-A3B-NVFP4-MTP-GGUF

Добавлено:
michaelw9999/Qwen3.6-35B-A3B-NVFP4-MTP-GGUF

Этот репозиторий содержит два экспериментальных квантования NVFP4 GGUF Qwen3.6-35B-A3B для llama.cpp. Это было квантовано с помощью моего экспериментального инструмента Advanced-gguf-quantizer. Обе модели были впервые откалиброваны с помощью imatrix с использованием нового пользовательского набора данных, который я оцениваю. Все результаты PPL/KLD были измерены на основе той же базы KLD викитеста BF16, а затем сравнены с официальной версией NVFP4 от NVIDIA. В настоящее время проводятся дальнейшие оценочные испытания для выявления реальных различий в производительности между TURBO и HQ.

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: michaelw9999
Теги: gguf, qwen3.6, qwen3.6-35b, nvfp4, llama.cpp, michaelw9999, qwen, blackwell
Лайков: 6  |  Загрузок: 162,416

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.