Модель NVIDIA gpt-oss-120b Eagle является главой Eagle модели gpt-oss-120b OpenAI, которая представляет собой авторегрессионную языковую модель, использующую архитектуру смешанных экспертов (MoE) с 5 миллиардами активированных параметров и 120 миллиардами общих параметров. Для получения дополнительной информации, пожалуйста, проверьте здесь. Модель NVIDIA gpt-oss-120b Eagle3 включает спекулятивное декодирование Eagle с помощью Model Optimizer. Этот модуль EAGLE3 можно использовать только для составления одного прогнозируемого токена. Он имеет высокую скорость принятия и полезен для вывода с высокой степенью параллелизма, когда один предполагаемый токен является оптимальной конфигурацией. Он также сохраняет высокий уровень приемлемости для использования в длительном контексте. Разработчики, разрабатывающие системы AI Agent, чат-боты, системы RAG и другие приложения на базе AI. Также подходит для типичных задач по выполнению инструкций. Huggingface: 20 августа 2025 г., [https://huggingface.co/nvidia/gpt-oss-120b-Eagle3] Тип архитектуры: Трансформаторы Сетевая архитектура: gpt-oss-120b ##Вычислительная нагрузка Совокупные вычисления: 4,8×10^20 Расчетная энергия и выбросы для обучения модели: всего кВтч = 2500 общих выбросов (tCO2e) = 0,8075 Тип(ы) ввода: Формат(ы) текстового ввода: Строка Параметры ввода: Один…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: nvidia
Теги: Model Optimizer, llama, nvidia, ModelOpt, gpt-oss-120b, quantized, Eagle3
Лайков: 33 | Загрузок: 1,661
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.