Qwen3-30B-A3B-Thinking-2507-Eagle3
The NVIDIA Qwen3-30B-A3B-Thinking-2507 Eagle model is the Eagle head of the Alibaba’s Qwen3-30B-A3B-Thinking-2507 model, which is an auto-regressive...
The NVIDIA Qwen3-30B-A3B-Thinking-2507 Eagle model is the Eagle head of the Alibaba’s Qwen3-30B-A3B-Thinking-2507 model, which is an auto-regressive...
We introduce the updated version of the Qwen3-235B-A22B non-thinking mode, named Qwen3-235B-A22B-Instruct-2507, featuring the following key enhancements: —...
Nex-N2-mini с квантованием NVFP4 (тонкая настройка Qwen3.5-MoE-35B), оптимизированная для NVIDIA Blackwell (SM 12.1), обслуживающая через vLLM с ядрами...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: RazielXYZ Теги: qwen3_5_moe, quantized, fp4,...
Первое квантование NVFP4 сообщества google/gemma-4-26B-A4B-it — вариант Gemma 4, созданный смешанными экспертами, с общим числом параметров 25,2 млрд...
Модель NVIDIA Qwen3-235B-A22B FP8 представляет собой квантованную версию модели Qwen3-235B-A22B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Модель NVIDIA Kimi-K2.7-Code NVFP4 представляет собой квантованную версию модели Kimi-K2.7-Code компании Moonshot AI, которая представляет собой авторегрессионную языковую...
Квантование NVFP4 (4-битное) zai-org/GLM-5.2, созданное с помощью NVIDIA TensorRT Model Optimizer 0.44.0. Экспертные FFN MoE (маршрутизируемые + общие)...
Квантование LiquidAI/LFM2.5-8B-A1B NVFP4 (W4A4) — 8,3-битный / 1,5-активный процессор смешанных экспертов (контекст 131 КБ) работает на одном графическом...
Модель txn545/Qwen3.5-35B-A3B-NVFP4 представляет собой квантованную версию модели Qwen3.5-35B-A3B от Alibaba, авторегрессионной языковой модели, в которой используется оптимизированная архитектура...