Qwen3-Coder-Next-NVFP4-GB10
Весовые коэффициенты идентичны байтам вышестоящего количества (проверено config.json и model.safetensors.index.json SHA-256). Это зеркало существует для обеспечения закрепленной, стабильной,...
Весовые коэффициенты идентичны байтам вышестоящего количества (проверено config.json и model.safetensors.index.json SHA-256). Это зеркало существует для обеспечения закрепленной, стабильной,...
Первое квантование NVFP4 сообщества google/gemma-4-26B-A4B-it — вариант Gemma 4, созданный смешанными экспертами, с общим числом параметров 25,2 млрд...
Квантование NVFP4 Qwen3.6-27B с помощью головок Multi-Token Prediction (MTP), преобразованное в формат GGUF с использованием llama.cpp. Это квантование...
Ключевые слова: vLLM DGX Spark, NVIDIA GB10, Blackwell GPU, SM121, ARM64 LLM, CUDA 13.1, запуск докера вывода Qwen3...
Рекалибровка Agentic + Coder MiniMax-M2.7 NVFP4-GB10. Та же архитектура и схема квантования, что и у saricles/MiniMax-M2.7-NVFP4-GB10, но откалиброваны...
> Примечание. Эта модель оптимизирована для графических процессоров Blackwell (SM121). Для H100/A100 рассмотрите версию BF16 с нашим многоарочным...