Метка: compressed-tensors - Страница 4 - Каталог нейросетей

Метка: compressed-tensors

Генерация текста

stelterlab/Qwen3-Coder-30B-A3B-Instruct-AWQ

Обновленное квантование AWQ: выполнено stelterlab в INT4 GEMM с помощью llm-compressor (https://github.com/vllm-project/llm-compressor) из vllm-project. Все еще пытаюсь познакомиться...

Генерация текста

sudo-0x2a/Qwen3.6-27B-NVFP4-GPTQ

В этом репозитории размещена квантованная версия модели Qwen3.6-27B NVFP4. Процесс квантования выполнялся с использованием llm-compressor с использованием стратегии...

Генерация текста

ibm-granite/granite-4.1-30b-fp8

> [!NOTE] > Этот репозиторий содержит версию FP8 4.1-30B. > > Дополнительную информацию см. в карточке модели оригинальной...

Генерация текста

cyankiwi/Qwen3-4B-Instruct-2507-AWQ-4bit

Квантовано с использованием vllm-project/llm-compressor, nvidia/Llama-Nemotron-Post-Training-Dataset и следующих конфигураций: Мы представляем обновленную версию режима без мышления Qwen3-4B под названием...

Генерация текста

nytopop/Qwen3-30B-A3B.w4a16

В настоящее время восходящий сленг неправильно загружает этот квант из-за нескольких незначительных проблем. Пока восходящий поток не будет...

Генерация текста

ibm-granite/granite-4.1-3b-fp8

> [!NOTE] > Этот репозиторий содержит версию FP8 4.1-3B. > > Дополнительную информацию см. в карточке модели исходной...