Метка: glm4_moe - Страница 3 - Каталог нейросетей

Метка: glm4_moe

Генерация текста

RESMP-DEV/GLM-4.6-NVFP4

Квантованная версия GLM-4.6 с использованием LLM Compressor и формата NVFP4 (E2M1 + E4M3). Это должно стать началом новой...

Генерация текста

turboderp/GLM-4.6-exl3-2.33bpw-opt

Это всего лишь быстрое сочетание кванта 2,25 бита в неделю с вниманием, плотными слоями и общими экспертами в...

Генерация текста

bullpoint/GLM-4.6-AWQ

Высокопроизводительное AWQ-квантование ZHIPU AI GLM-4.6 (357B MoE), оптимизированное для вывода vLLM. Это профессионально квантованная 4-битная AWQ-версия Z.ai GLM-4.6,...

Генерация текста

QuantTrio/GLM-4.6-AWQ

По состоянию на 1 октября 2025 г. создайте новую среду Python и запустите: 👋 Присоединяйтесь к нашему сообществу...

Генерация текста

PrimeIntellect/GLM-0.5B

👋 Присоединяйтесь к нашему сообществу Discord. 📖 Ознакомьтесь с техническим блогом GLM-4.5, техническим отчетом и технической документацией Zhipu...

Генерация текста

concedo/Huihui-GLM-4.5-Air-abliterated-lossytensors

Это версия Huihui-GLM-4.5-Air-abliterated-GGUF с потерями защитных тензоров, которую можно запускать с преобразователями Huggingface, поскольку исходная версия не включала...

Генерация текста

QuantTrio/GLM-4.5-GPTQ-Int4-Int8Mix

👋 Присоединяйтесь к нашему сообществу Discord. 📖 Посетите технический блог GLM-4.5. 📍 Используйте сервисы API GLM-4.5 на платформе...

Генерация текста

cyankiwi/GLM-4.7-REAP-268B-A32B-AWQ-4bit

𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-268B-A32B, сжатый вариант GLM-4.7 с эффективным использованием...

Генерация текста

Tengyunw/GLM-4.7-NVFP4

我们在做什么: — 推理加速:实现了 Eagle3 для обучения на Qwen3-8B (более 20 000 загрузок),显著提升LLM推理速度 — Производительность графического процессора: AIGC, поддержка...

Генерация текста

nota-ai/GLM-4.5-Air-NotaMoeQuant-Int4

Мы разработали метод квантования только по весу, специально предназначенный для архитектуры Mixture-of-Experts (MoE), и выпустили GLM-4.5-Air, квантованный с...