bartowski/OpenBuddy_OpenBuddy-R1-0528-Distill-Qwen3-32B-Preview0-QAT-GGUF - Каталог нейросетей
Генерация текста

bartowski/OpenBuddy_OpenBuddy-R1-0528-Distill-Qwen3-32B-Preview0-QAT-GGUF

Добавлено:
bartowski/OpenBuddy_OpenBuddy-R1-0528-Distill-Qwen3-32B-Preview0-QAT-GGUF

Исходная модель: https://huggingface.co/OpenBuddy/OpenBuddy-R1-0528-Distill-Qwen3-32B-Preview0-QAT. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) являются стандартным методом квантования, в котором вложения и выходные веса квантуются до Q8_0 вместо того, что они обычно по умолчанию. Если модель больше 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их все в локальную папку, запустите: Вы можете указать новый локальный каталог (OpenBuddyOpenBuddy-R1-0528-Distill-Qwen3-32B-Preview0-QAT-Q80) или загрузить их все на месте (./). Раньше вы загружали Q4044/48/8_8, и их веса чередовались в памяти, чтобы повысить производительность на ARM и AVX. машины, загружая больше данных за один проход. Однако сейчас существует так называемая «онлайн-переупаковка» весов. подробности в этом PR. Если вы используете Q4_0 и ваше оборудование выиграет от переупаковки весов, оно сделает это автоматически на лету. Начиная с сборки llama.cpp b4282, вы не сможете запускать файлы Q40XX, и вместо этого вам придется использовать Q40. Кроме того, если вы хотите получить немного лучшее качество для , вы можете…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: bartowski
Теги: gguf, qwen3, zh, en, fr, de, ja, ko
Лайков: 5  |  Загрузок: 2,010

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.