Метка: compressed-tensors - Каталог нейросетей

Метка: compressed-tensors

Генерация текста

canada-quant/hy3-w4a16-mtp

> Выпущено 16 июля 2026 г. Все этапы пройдены: проверка артефакта (—check-mtp), > качество по сравнению с FP8...

Генерация текста

olka-fi/Hy3-MXFP4

> 4-битное квантование MXFP4 tencent/Hy3. > Оригинальная карта модели полностью сохранена ниже. Квант MXFP4 только по весу, создаваемый...

Генерация текста

olka-fi/Ornith-1.0-397B-MXFP4

4-битное квантование MXFP4 Ornith-1.0-397B, созданное с помощью qstream. Только перенаправленные эксперты MoE (~95% весов) квантуются в MXFP4; все,...

Генерация текста

scottgl/Qwen3.5-122B-A10B-NVFP4-GB10

Qwen3.5-122B-A10B оптимизирован для NVIDIA DGX Spark (GB10, SM12.1) — все квантования встроены. Эта контрольная точка получена из Sehyo/Qwen3.5-122B-A10B-NVFP4...

Генерация текста

jdopensource/JoyAI-LLM-Flash-INT4

JoyAI-LLM-Flash — это современная модель языка инструкций среднего размера с 3 миллиардами активированных параметров и 48 миллиардами общих...

Генерация текста

TheHouseOfTheDude/GLM-4.7_Compressed-Tensors

В этом репозитории представлены квантованные сборки zai-org/GLM-4.7 (модель Mixture-of-Experts), переупакованные для vLLM с использованием формата сжатых тензоров. >...