ZeroWw/Llama-3.1-Minitron-4B-Width-Base-GGUF - Каталог нейросетей
Генерация текста

ZeroWw/Llama-3.1-Minitron-4B-Width-Base-GGUF

Добавлено:
ZeroWw/Llama-3.1-Minitron-4B-Width-Base-GGUF

Мои собственные (ZeroWw) квантования. выходные и встроенные тензоры квантованы на f16. все остальные тензоры квантованы на q5k или q6k. Результат: как f16.q6, так и f16.q5 меньше, чем стандартное квантование q8_0, и они работают так же хорошо, как и чистый f16.

Модальности:
Генерация текста


Задача: Генерация текста
Автор: ZeroWw
Теги: gguf, en, endpoints_compatible
Лайков: 3  |  Загрузок: 109

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.