Узнайте, как запустить GLM-5 локально — прочтите наше руководство! Unsloth Dynamic 2.0 обеспечивает превосходную точность и превосходит другие ведущие методы количественного анализа. —————————— | ———————- | ——— | ————- |————| ————— | ———— | ————— | > *: относится к их оценкам полного набора. > > †: проверенная версия Terminal-Bench 2.0, исправляющая некоторые неоднозначные инструкции. См. сноску для получения более подробной информации об оценке. Последний экзамен человечества (HLE) и другие логические задачи: мы оцениваем максимальную длину генерации 131 072 токена (температура = 1,0, topp = 0,95, maxnewtokens = 131072). По умолчанию мы сообщаем о текстовом подмножестве; результаты, отмеченные значком, относятся к полному набору. В качестве судейской модели мы используем GPT-5.2 (средний). Для HLE с инструментами мы используем максимальную длину контекста 202 752 токена. SWE-bench и SWE-bench Multilingual: мы запускаем пакет SWE-bench с помощью OpenHands, используя специальную подсказку инструкций. Настройки: температура=0,7, topp=0,95, maxnewtokens=16384, с контекстным окном 200К. BrowserComp: без управления контекстом мы сохраняем детали за последние 5 ходов. При управлении контекстом мы используем ту же стратегию отказа от всего, что и DeepSeek-v3.2 и Kimi…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: unsloth
Теги: gguf, unsloth, glm_moe_dsa, en, zh, endpoints_compatible, imatrix, conversational
Лайков: 199 | Загрузок: 78,761
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.