Квантование GGUF Gemma-4-31B-JANG_4M-CRACK для использования с llama.cpp, LM Studio, Ollama и другими механизмами вывода, совместимыми с GGUF. — Базовая модель: google/gemma-4-31b-it — Архитектура: Gemma 4 Dense Transformer (31B параметров, 60 слоев) — Особенности: Hybrid Sliding/Global Attention, Vision + Audio multimodal — Модификация: CRACK аблитерация (удаление отказа) + квантование смешанной точности JANG v2 В исходной модели используется квантование MLX смешанной точности JANG v2 (внимание 8 бит + MLP) 4-битный), который совместим только с vMLX. Стандартные инструменты (llama.cpp, LM Studio, oMLX, mlx-lm) не могут загрузить этот формат из-за разной разрядности каждого слоя. Этот репозиторий предоставляет стандартные квантования GGUF, которые работают везде. В этой модели сняты защитные ограждения. Используйте ответственно и в соответствии с действующим законодательством.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: douyamv
Теги: gguf, gemma4, quantized, 31b, en, endpoints_compatible, conversational
Лайков: 31 | Загрузок: 335
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.