Метка: int4 - Страница 3 - Каталог нейросетей

Метка: int4

Генерация текста

study-hjt/Meta-Llama-3-70B-Instruct-GPTQ-Int4

Мы используем репозиторий Swift Modelscope для выполнения квантования GPTQ. Документацию по квантованию можно найти здесь. Команда квантования следующая:...

Генерация текста

huawei-csl/Qwen3-32B-4bit-SINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-32B с использованием метода SINQ (Sinkhorn-Normalized Quantization). SINQ — это...

Генерация текста

RedHatAI/Qwen3-30B-A3B-quantized.w4a16

— Архитектура модели: Qwen3ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...

Генерация текста

RedHatAI/DeepSeek-R1-quantized.w4a16

— Архитектура модели: DeepseekV3ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование активации:...

Генерация текста

ayysasha/MiniMax-M2.7-AWQ-G32-STRIX-2H

MiniMax-M2.7-AWQ-G32-STRIX-2H — это AWQ-квантование смешанной точности amd/MiniMax-M2.7-BF16, созданное для двухузлового вывода AMD Strix Halo (gfx1151) с тензорным параллелизмом...

Генерация текста

huawei-csl/Qwen3-32B-4bit-ASINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-32B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). Этот...