gpt-oss-120b-speculator.eagle3
— Verifier: openai/gpt-oss-120b — Speculative Decoding Algorithm: EAGLE-3 — Model Architecture: Eagle3Speculator — Release Date: 03/10/2026 — Version:...
— Verifier: openai/gpt-oss-120b — Speculative Decoding Algorithm: EAGLE-3 — Model Architecture: Eagle3Speculator — Release Date: 03/10/2026 — Version:...
The NVIDIA Qwen3-30B-A3B-Thinking-2507 Eagle model is the Eagle head of the Alibaba’s Qwen3-30B-A3B-Thinking-2507 model, which is an auto-regressive...
DeepSeek-V4-Flash-EAGLE3.1 — это черновой вариант спекулятивного декодирования EAGLE-3.1 для ускорения вывода DeepSeek-V4-Flash. Насколько нам известно, это первый общедоступный...
kimi-k2.6-eagle3-mla — это черновая модель Eagle3 MTP с MLA (Multi-Latent Attention) для ускорения вывода Kimi-K2.6, обученная с помощью...
Черновой вариант спекулятивного декодирования для google/gemma-4-31B, обученный с использованием метода EAGLE3 на графических процессорах NVIDIA H200 с помощью...
Легкая вытяжная головка EAGLE3 для MiniMax-M2.5 (229B MoE, ~10B активных параметров). Обучение проходило в SpecForge на 8 графических...
— Верификатор: Qwen/Qwen3-32B — Алгоритм спекулятивного декодирования: EAGLE-3 — Архитектура модели: Eagle3Speculator — Дата выпуска: 17.09.2025 — Версия:...
Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: lightseekorg Теги: llama, kimi-k2.6, eagle3, torchspecЛайков: 9 | Загрузок:...
NVIDIA gpt-oss-120b — это вариант Eagle-head модели OpenAI gpt-oss-120b, авторегрессионной языковой модели, использующей архитектуру смешанных экспертов (MoE) с...
Модель NVIDIA Qwen3-235B-A22B Eagle является главой Eagle модели Qwen3-235B-A22B от Alibaba, которая представляет собой авторегрессионную языковую модель, использующую...