Qwen3-4B-Instruct-2507-GPTQ-Int4
This model is quantized to 4-bit with a group size of 128. Compared to earlier quantized versions, the...
This model is quantized to 4-bit with a group size of 128. Compared to earlier quantized versions, the...
За последние три месяца мы продолжали масштабировать способность мышления Qwen3-30B-A3B, улучшая как качество, так и глубину рассуждений. Мы...
Over the past three months, we have continued to scale the thinking capability of Qwen3-235B-A22B, improving both the...
We introduce the updated version of the Qwen3-235B-A22B non-thinking mode, named Qwen3-235B-A22B-Instruct-2507, featuring the following key enhancements: —...
The DeepSeek R1 model has undergone a minor version upgrade, with the current version being DeepSeek-R1-0528. In the...
Эта модель квантуется до 4-бит с размером группы 128. По сравнению с более ранними квантованными версиями, новая квантованная...
Эта модель квантуется до 4-бит с размером группы 128. По сравнению с более ранними квантованными версиями, новая квантованная...
Эта модель квантуется до 8 бит с размером группы 128. По сравнению с более ранними квантованными версиями, новая...
Эта модель квантуется до 4-бит с размером группы 128. По сравнению с более ранними квантованными версиями, новая квантованная...
Модуль awqmarlin в vllm не проверяет параметр elementstonotconvert при загрузке модулей AWQ-MoE, что приводит к сбою смешанного квантования...