Модель NVIDIA gpt-oss-120b Eagle является главой Eagle модели gpt-oss-120b OpenAI, которая представляет собой авторегрессионную языковую модель, использующую архитектуру смешанных экспертов (MoE) с 5 миллиардами активированных параметров и 120 миллиардами общих параметров. Для получения дополнительной информации, пожалуйста, проверьте здесь. Модель NVIDIA gpt-oss-120b Eagle3 включает спекулятивное декодирование Eagle с помощью Model Optimizer. nvidia/gpt-oss-120b-Eagle3-short-context обычно лучше подходит для случаев использования с длиной контекста менее 8 КБ. Разработчики, разрабатывающие системы AI Agent, чат-боты, системы RAG и другие приложения на базе AI. Также подходит для типичных задач по выполнению инструкций. Huggingface: 6 октября 2025 г. через [https://huggingface.co/nvidia/gpt-oss-120b-Eagle3-short-context] Тип архитектуры: Трансформаторы Сетевая архитектура: gpt-oss-120b ##Вычислительная нагрузка Совокупные вычисления: 4,8×10^20 Расчетная энергия и выбросы для обучения модели: Всего кВтч = 2500 Всего Выбросы (tCO2e) = 0,8075 Типы входных данных: Текстовый формат входных данных: Строковые Входные параметры: Одномерные (1D): Последовательности Типы выходных данных: Формат текстовых выходных данных: Строковые Выходные параметры: Одномерные (1D): Последовательности Наши модели искусственного интеллекта разработаны и/или…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: nvidia
Теги: Model Optimizer, llama, nvidia, ModelOpt, gpt-oss-120b, quantized, Eagle3
Лайков: 16 | Загрузок: 2,176
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.