— размер словаря 152064, такой же, как у QwQ-32B-Preview (может использоваться непосредственно в VLLM без каких-либо хаков) — обучение на Qwen/Qwen2.5-Coder-0.5B-Instruct — на PowerInfer/QWQ-LONGCOT-500K 2 эпохи — коэффициент принятия черновиков выше 0,8 — скорость токена до x2,5 в математических задачах (33 токс/с против 85 токс/с)
Модальности:
Генерация текста
Области применения:
Диалог / чат Генерация кода
Задача: Генерация текста
Автор: tugstugi
Теги: qwen2, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 9
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.