Метка: efficient-inference - Страница 2 - Каталог нейросетей

Метка: efficient-inference

Генерация текста

huawei-csl/Qwen3-32B-4bit-SINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-32B с использованием метода SINQ (Sinkhorn-Normalized Quantization). SINQ — это...

Генерация текста

huawei-csl/Qwen3-1.7B-3bit-ASINQ

Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-1.7B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). SINQ...

Генерация текста

huawei-csl/Qwen3-1.7B-3bit-SINQ

Этот репозиторий содержит официальную 3-битную квантованную версию модели Qwen3-1.7B с использованием метода SINQ (Sinkhorn-Normalized Quantization). SINQ — это...

Генерация текста

huawei-csl/Qwen3-32B-4bit-ASINQ

Этот репозиторий содержит официальную 4-битную квантованную версию модели Qwen3-32B с использованием калиброванной версии метода SINQ (Sinkhorn-Normalized Quantization). Этот...

Генерация текста

sudeshmu/fine_tune

— Размер модели: 360 млн параметров — Архитектура: на основе LLaMA с модификациями MoR — Длина контекста: 1024...

Генерация текста

Zhayr1/BitMamba-2-1B

BitMamba-2-1B — это масштабируемая гибридная архитектура, которая интегрирует 1,58-битное троичное квантование (BitNet) в структуру модели пространства состояний Mamba-2....