Весовые коэффициенты идентичны байтам вышестоящего количества (проверено config.json и model.safetensors.index.json SHA-256). Это зеркало существует для обеспечения закрепленной, стабильной, несинхронизированной ссылки для проекта развертывания qwen3-coder-next на DGX Spark (GB10). Используйте восходящее репозиторий, если вы хотите отслеживать обновления автора. — Базовая модель: Qwen/Qwen3-Coder-Next от команды Alibaba / Qwen (Apache-2.0) — Квантование NVFP4: сарикулы с использованием компрессора LLM с LLMCOMPRESSORMOECALIBRATEALLEXPERTS =1 (все 512 экспертов откалиброваны) — Калибровочные данные: HuggingFaceH4/ultrachat200k (64 образца × 2048 токов) — Лицензия: Apache-2.0** (унаследована от базовой модели; разрешено перераспределение) — Архитектура: qwen3next — Гибридное линейное внимание DeltaNet полное внимание латентное MoE — Слои: 48 всего (36 линейных-атте DeltaNet
Модальности:
Генерация текста
Области применения:
Генерация кода Диалог / чат
Задача: Генерация текста
Автор: ucbye
Теги: qwen3_next, qwen3, nvfp4, 4-bit, quantized, compressed-tensors, vllm, DGX-Spark
Лайков: 4 | Загрузок: 535,749
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.