douyamv/Gemma-4-31B-JANG_4M-CRACK-GGUF - Каталог нейросетей
Генерация текста

douyamv/Gemma-4-31B-JANG_4M-CRACK-GGUF

Добавлено:
douyamv/Gemma-4-31B-JANG_4M-CRACK-GGUF

Квантование GGUF Gemma-4-31B-JANG_4M-CRACK для использования с llama.cpp, LM Studio, Ollama и другими механизмами вывода, совместимыми с GGUF. — Базовая модель: google/gemma-4-31b-it — Архитектура: Gemma 4 Dense Transformer (31B параметров, 60 слоев) — Особенности: Hybrid Sliding/Global Attention, Vision + Audio multimodal — Модификация: CRACK аблитерация (удаление отказа) + квантование смешанной точности JANG v2 В исходной модели используется квантование MLX смешанной точности JANG v2 (внимание 8 бит + MLP) 4-битный), который совместим только с vMLX. Стандартные инструменты (llama.cpp, LM Studio, oMLX, mlx-lm) не могут загрузить этот формат из-за разной разрядности каждого слоя. Этот репозиторий предоставляет стандартные квантования GGUF, которые работают везде. В этой модели сняты защитные ограждения. Используйте ответственно и в соответствии с действующим законодательством.

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: douyamv
Теги: gguf, gemma4, quantized, 31b, en, endpoints_compatible, conversational
Лайков: 31  |  Загрузок: 335

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.