Falcon3-10B-Instruct-gptqmodel-4bit-vortex-v1
— bits: 4 — dynamic: null — groupsize: 32 — descact: true — staticgroups: false — sym: true...
— bits: 4 — dynamic: null — groupsize: 32 — descact: true — staticgroups: false — sym: true...
— bits: 4 — dynamic: null — groupsize: 32 — descact: true — staticgroups: false — sym: true...
4-bit GPTQ (W4A16) quantization of deepseek-ai/DeepSeek-V4-Flash-0731, produced with GPTQModel. This is the V1 release (first calibration run). A...
Эта модель была 4-разрядной квантованной моделью Llada-8B-Base с GPTQModel. — bits: 4 — dynamic: null — groupsize: 128...
— биты: 4 — размер группы: 128 — уменьшение: true — staticgroups: false — sym: true — lmhead:...
— биты: 4 — размер группы: 128 — descact: true — staticgroups: false — sym: true — lmhead:...
Эта модель была квантована с использованием GPTQModel. — биты: 4 — размер группы: 128 — descact: false —...
Эти модели создаются и обслуживаются на арендованных графических процессорах. Если вы хотите выразить некоторую признательность, подписка на X...
> Квантование GPTQ INT4 Qwen/Qwen3.6-27B. > в 3 раза меньше. ~2,4× быстрее. Однопоточное измерение на том же оборудовании,...
— биты: 4 — динамический: нуль — размер группы: 32 — descact: true — staticgroups: false — sym:...