GLM-4.7-NVFP4
我们在做什么: — 推理加速:实现了 Eagle3 для обучения на Qwen3-8B (более 20 000 загрузок),显著提升LLM推理速度 — Производительность графического процессора: AIGC, поддержка...
我们在做什么: — 推理加速:实现了 Eagle3 для обучения на Qwen3-8B (более 20 000 загрузок),显著提升LLM推理速度 — Производительность графического процессора: AIGC, поддержка...
Модель NVIDIA Qwen3-14B FP8 — это квантованная версия модели Qwen3-14B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Модель NVIDIA Qwen3-8B FP8 — это квантованная версия модели Qwen3-8B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Квантование MiniMaxAI/MiniMax-M2.7 высокого качества NVFP4 для графических процессоров NVIDIA Blackwell. 5000 калибровочных образцов в 5 различных наборах данных....
Модель NVIDIA Qwen3-Coder-Next-NVFP4 представляет собой квантованную версию модели Qwen3-Coder-Next, авторегрессионной языковой модели, которая использует оптимизированную архитектуру Transformer с...
Квантованная NVFP4 текстовая сборка GGUF Qwen3.6-27B для llama.cpp на NVIDIA DGX Spark (GB10, SM121). Это основная модель кодирования...
Модель NVIDIA Qwen3-235B-A22B-Thinking-2507 NVFP4 представляет собой квантованную версию модели Qwen3-235B-A22B-Thinking-2507 от Alibaba, которая представляет собой авторегрессионную языковую модель,...
Модель NVIDIA Qwen2.5-VL-7B-Instruct-FP8 представляет собой квантованную версию модели Qwen2.5-VL-7B-Instruct от Alibaba, которая представляет собой авторегрессионную языковую модель, использующую...
Модель NVIDIA DeepSeek R1 FP4 v2 — это квантованная версия модели DeepSeek R1 компании DeepSeek AI, которая представляет...
Модель mmangkad/Qwen3.6-35B-A3B-NVFP4 представляет собой квантованную версию модели Qwen3.6-35B-A3B от Alibaba, авторегрессионной языковой модели, использующей оптимизированную архитектуру преобразователя. Более...