Tongyi-Zhiwen/QwenLong-L1-32B - Каталог нейросетей
Генерация текста

Tongyi-Zhiwen/QwenLong-L1-32B

Добавлено:
Tongyi-Zhiwen/QwenLong-L1-32B

Фанци Ван, Вэйчжоу Шен, Шэньи Ляо, Инчэн Ши, Чэньлян Ли, — 28 мая 2025 г.: 🔥 Мы выпускаем 🤗 QwenLong-L1-32B-AWQ, который прошел квантование AWQ int4 с использованием платформы ms-swift. — 26 мая 2025 г.: 🔥 Мы выпускаем 🤗 QwenLong-L1-32B, который является первым LRM с длинным контекстом, обученным с помощью обучения с подкреплением для рассуждений в длинном контексте. Эксперименты на семи долгоконтекстных тестах DocQA показывают, что QwenLong-L1-32B превосходит флагманские LRM, такие как OpenAI-o3-mini и Qwen3-235B-A22B, достигая производительности на уровне Claude-3.7-Sonnet-Thinking, демонстрируя лидирующую производительность среди современных LRM. — 26 мая 2025 г.: 🔥 Мы выпускаем 🤗 DocQA-RL-1.6K, который представляет собой специализированный набор данных для обучения RL, включающий 1,6 тыс. документальных задач с ответами на вопросы (DocQA), охватывающих математические, логические и многошаговые области рассуждения. В этой работе мы предлагаем QwenLong-L1, новую структуру обучения с подкреплением (RL), предназначенную для облегчения перехода LRM от навыков краткого контекста к надежному обобщению длинного контекста. В наших предварительных экспериментах мы иллюстрируем различия между динамикой обучения RL с коротким и длинным контекстом. Наша структура расширяет…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Tongyi-Zhiwen
Теги: qwen2, long-context, large-reasoning-model, conversational, text-generation-inference, endpoints_compatible
Лайков: 167  |  Загрузок: 167

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.