bartowski/huizimao_gpt-oss-120b-uncensored-bf16-GGUF - Каталог нейросетей
Генерация текста

bartowski/huizimao_gpt-oss-120b-uncensored-bf16-GGUF

Добавлено:
bartowski/huizimao_gpt-oss-120b-uncensored-bf16-GGUF

Исходная модель: https://huggingface.co/huizimao/gpt-oss-120b-uncensored-bf16. Все кванты, выполненные с использованием опции imatrix с набором данных отсюда, в сочетании с набором данных Эда Аддарио отсюда. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Причина в том, что FFN (сети прямой связи) gpt-oss ведут себя некорректно при квантовании ни к чему другому, кроме MXFP4, поэтому они сохраняются на этом уровне во всем. Остальные предоставлены для вашего собственного интереса на случай, если вы захотите поэкспериментировать, но экономия размера практически отсутствует, поэтому я бы не рекомендовал их запускать, они предоставлены просто для галочки: некоторые из этих квантов (Q3KXL, Q4KL и т. д.) являются стандартным методом квантования с вложениями и выходными весами, квантованными до Q8_0 вместо того, что обычно используется по умолчанию. Если модель больше 50 ГБ, она будет разделена на несколько файлов. Чтобы загрузить их все в локальную папку, запустите: Вы можете либо указать новый локальный каталог (huizimaogpt-oss-120b-uncensored-bf16-Q80), либо загрузить их все на месте (./). Раньше вы загружали Q4044/48/8_8, и их веса чередовались в памяти для повышения производительности…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: bartowski
Теги: gguf, endpoints_compatible, imatrix, conversational
Лайков: 18  |  Загрузок: 1,735

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.