Метка: compression - Страница 2 - Каталог нейросетей

Метка: compression

Генерация текста

huawei-csl/Qwen3-14B-3bit-SINQ

Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-14B с использованием метода SINQ (Sinkhorn-Normalized Quantization). Модель и метод...

Генерация текста

ethzanalytics/gpt-j-8bit-daily_dialogues

Эта версия hivemind/gpt-j-6B-8bit точно настроена на проанализированную версию набора данных ежедневных диалогов для эпохи. Его можно использовать как...

Генерация текста

huawei-csl/Qwen3-4B-PreSINQ-GGUF

Этот репозиторий содержит официальные версии модели Qwen3-4B, квантованные PreSINQ GGUF. Подробное объяснение стратегии PreSINQ можно найти в официальном...

Генерация текста

cyankiwi/GLM-4.7-REAP-268B-A32B-AWQ-4bit

𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-268B-A32B, сжатый вариант GLM-4.7 с эффективным использованием...

Генерация текста

bartowski/cerebras_MiniMax-M2-REAP-162B-A10B-GGUF

Исходная модель: https://huggingface.co/cerebras/MiniMax-M2-REAP-162B-A10B Все кванты созданы с использованием опции imatrix с набором данных отсюда в сочетании с подмножеством...

Генерация текста

cerebras/GLM-4.6-REAP-252B-A32B-FP8

𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.6-REAP-252B-A32B-FP8, сжатый вариант GLM-4.6-FP8 с эффективным использованием...

Генерация текста

huawei-csl/Qwen3-14B-4bit-ASINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-14B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...

Генерация текста

huawei-csl/Qwen3-32B-3bit-SINQ

Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-32B с использованием метода SINQ (Sinkhorn-Normalized Quantization), как представлено в...