Метка: quantization - Каталог нейросетей

Метка: quantization

Генерация текста

legraphista/DeepSeek-V2-Lite-IMat-GGUF

Иматричное квантование Llama.cpp deepseek-ai/DeepSeek-V2-Lite Исходная модель: deepseek-ai/DeepSeek-V2-Lite Исходный тип dtype: BF16 (bfloat16) Квантизация: llama.cpp https://github.com/ggerganov/llama.cpp/pull/7519 Набор данных IMatrix:...

Генерация текста

wepiqx/Qwable-9B-Claude-Fable-5-SHQ8-GGUF

> Семейство адаптивного квантования для гибридной архитектуры Qwen3.5-9B Gated DeltaNet + Full Attention. Каждый вариант использует реальные данные...

Генерация текста

tzervas/qwen2.5-coder-14b-bitnet-1.58b

Архитектура: 14,7 миллиардов параметров | 1,58-битное троичное квантование BitNet. Это экспериментальное 1,58-битное квантование BitNet модели Qwen2.5-Coder-14B-Instruct с использованием...

Генерация текста

huawei-csl/Qwen3-14B-4bit-SINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-14B с использованием метода SINQ (Sinkhorn-Normalized Quantization), как представлено в...

Генерация текста

huawei-csl/Qwen3-1.7B-4bit-ASINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-1.7B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...

Генерация текста

huawei-csl/Qwen3-1.7B-4bit-SINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-1.7B с использованием метода SINQ (Sinkhorn-Normalized Quantization). SINQ — это...

Генерация текста

huawei-csl/Qwen3-32B-3bit-ASINQ

Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-32B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...

Генерация текста

huawei-csl/Qwen3-14B-3bit-ASINQ

Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-14B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...