Метка: quantization - Страница 2 - Каталог нейросетей

Метка: quantization

Генерация текста

huawei-csl/Qwen3-14B-3bit-SINQ

Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-14B с использованием метода SINQ (Sinkhorn-Normalized Quantization). Модель и метод...

Генерация текста

codelion/Qwen3-0.6B-accuracy-recovery-lora

Этот адаптер LoRA помогает восстановить точность при использовании квантованных версий Qwen/Qwen3-0.6B INT4. Он был обучен с использованием самодистилляции...

Генерация текста

legraphista/Llama-Guard-3-8B-IMat-GGUF

Llama.cpp imatrix квантование мета-ламы/Llama-Guard-3-8B Исходная модель: мета-llama/Llama-Guard-3-8B Исходный тип dtype: BF16 (bfloat16) Квантизация: llama.cpp b3447 Набор данных IMatrix:...

Генерация текста

legraphista/glm-4-9b-chat-IMat-GGUF

Исходная модель: THUDM/glm-4-9b-chat Исходный тип dtype: BF16 (bfloat16) Квантизация: https://github.com/ggerganov/llama.cpp/pull/6999 Набор данных IMatrix: здесь — Файлы — IMatrix...

Генерация текста

legraphista/K2-Chat-IMat-GGUF

Исходная модель: LLM360/K2-Chat Исходный тип dtype: FP16 (float16) Квантизация: llama.cpp b3051 Набор данных IMatrix: здесь — Файлы —...

Генерация текста

ethzanalytics/gpt-j-8bit-daily_dialogues

Эта версия hivemind/gpt-j-6B-8bit точно настроена на проанализированную версию набора данных ежедневных диалогов для эпохи. Его можно использовать как...

Генерация текста

wepiqx/Qwythos-9B-Claude-Mythos-5-1M-SHQ8-GGUF

> Примечание по исходной версии 2: после выполнения этих количественных оценок исходная версия была обновлена ​​до версии 2 с нормализацией...

Генерация текста

Mapika/GLM-5.2-NVFP4

Квантование NVFP4 (4-битное) zai-org/GLM-5.2, созданное с помощью NVIDIA TensorRT Model Optimizer 0.44.0. Экспертные FFN MoE (маршрутизируемые + общие)...

Генерация текста

w-ahmad/Qwen3.5-9B-GGUF-MoQ-MTP

Это репозиторий MTP. Спекулятивное декодирование MTP предназначено для более быстрой генерации. Оценка квантов приведена ниже. >MoQ (смесь квантов)...