Модель NVIDIA Qwen3-Next-80B-A3B-Thinking NVFP4 представляет собой квантованную версию модели Qwen3-Next-80B-A3B-Thinking от Alibaba, которая представляет собой авторегрессионную языковую модель, использующую оптимизированную архитектуру преобразователя. Для получения дополнительной информации, пожалуйста, проверьте здесь. Модель NVIDIA Qwen3-Next-80B-A3B-Thinking NVFP4 квантуется с помощью оптимизатора модели TensorRT. Эта модель не принадлежит и не разработана NVIDIA. Эта модель была разработана и построена в соответствии с требованиями третьей стороны для этого приложения и варианта использования; см. ссылку на карту модели, отличной от NVIDIA (Qwen3-Next-80B-A3B-Thinking). Разработчики, желающие использовать готовые предварительно квантованные модели для развертывания в системах AI Agent, чат-ботах, системах RAG и других приложениях на базе AI. Huggingface 29.12.2025 через https://huggingface.co/nvidia/Qwen3-Next-80B-A3B-Thinking-NVFP4 Тип архитектуры: Трансформаторы Сетевая архитектура: Qwen3NextForCausalLM Эта модель была разработана на основе Qwen3-Next-80B-A3B-Thinking Количество параметров модели: не разглашается. Тип(ы) ввода: Формат(ы) ввода текста: Строка Параметры ввода: 1D (одномерный): Последовательности Другие свойства, относящиеся к вводу: Длина контекста 262 144 исходно и с возможностью расширения до 1 010 000…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: nvidia
Теги: Model Optimizer, qwen3_next, nvidia, ModelOpt, Qwen3, quantized, NVFP4, nvfp4
Лайков: 53 | Загрузок: 111,202
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.