mlx-community/gemma-4-12B-coder-fable5-composer2.5-v1-4bit-msq - Каталог нейросетей
Генерация текста

mlx-community/gemma-4-12B-coder-fable5-composer2.5-v1-4bit-msq

Добавлено:
mlx-community/gemma-4-12B-coder-fable5-composer2.5-v1-4bit-msq

MLX-квантование смешанной точности для yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1, квантованное с помощью MLX Smart Quantize (MSQ) — моего собственного метода квантования смешанной точности на основе чувствительности для Apple Silicon. Он измеряет NMSE на каждом уровне и автоматически назначает оптимальную разрядность, сочетая знания об архитектуре с измеренными данными. — Тип: Vision (VLM). — Среднее значение: 4,5 бита на вес. — Метод: MLX Smart Quantize (MSQ). — Масштабирование AWQ: применяется к 96 группам.

Модальности:
Генерация текста

Области применения:
Генерация кода Логика и рассуждение Диалог / чат


Задача: Генерация текста
Автор: mlx-community
Теги: gemma4_unified, image-text-to-text, gemma4, coding, code, reasoning, thinking, conversational
Лайков: 6  |  Загрузок: 523

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.