Метка: glm_moe_dsa - Страница 3 - Каталог нейросетей

Метка: glm_moe_dsa

Генерация текста

jarrelscy/GLM-5.2-NVFP4-AQLM-hybrid

Параметр GLM-5.2 с 744 байтами, квантованный с помощью двухуровневой схемы NVFP4+AQLM для каждого эксперта, обслуживает полный кэш KV...

Генерация текста

brandonmusic/GLM-5.2-NVFP4-REAP-Recall-N172

Восстановленный из отзыва повторный REAP GLM-5.2-NVFP4 — 172 эксперта на уровень (из 256), самосогласованный, веса BF16 сохранены, эксперты...

Генерация текста

Mapika/GLM-5.2-NVFP4

Квантование NVFP4 (4-битное) zai-org/GLM-5.2, созданное с помощью NVIDIA TensorRT Model Optimizer 0.44.0. Экспертные FFN MoE (маршрутизируемые + общие)...

Генерация текста

mlx-community/GLM-5.1-DQ4plus-q8

Эта модель mlx-community/GLM-5.1-DQ4plus-q8 была преобразована в формат MLX из zai-org/GLM-5.1 с использованием mlx-lm версии 0.31.2. Это создано для...

Генерация текста

QuantTrio/GLM-5-AWQ

Этот репозиторий квантует модель с использованием квантования без данных (набор калибровочных данных не требуется). По состоянию на 26...

Генерация текста

mlx-community/GLM-5-4bit

Эта модель mlx-community/GLM-5-4bit была преобразована в формат MLX из zai-org/GLM-5 с использованием mlx-lm версии 0.30.7. Модальности:Генерация текста Области...