Mungert/Skywork-SWE-32B-GGUF - Каталог нейросетей
Генерация текста

Mungert/Skywork-SWE-32B-GGUF

Добавлено:
Mungert/Skywork-SWE-32B-GGUF

Эта модель была создана с использованием llama.cpp при фиксации 0142961a. крупномасштабный высококачественный набор данных с комплексными исполняемыми средами выполнения. Подробные описания доступны в нашем техническом отчете. Закон масштабирования данных для точности Pass@1 в LLM на базе Qwen2.5-Coder-32B с использованием платформы агента кода OpenHands v0.32.0. Skywork-SWE-32B значительно превосходит предыдущие LLM на базе Qwen2.5-Coder-32B, обеспечивая высочайшую точность прохода @ 1 без использования верификаторов или многократного развертывания. Благодаря использованию методов масштабирования во время испытаний Skywork-SWE-32B еще больше повышает точность до 47,0%, превосходя предыдущие результаты SoTA для моделей с параметрами ниже 32B. Поскольку наша модель имеет 32 миллиарда параметров и поддерживает длину контекста 32 КБ, мы рекомендуем запускать сервер модели как минимум с двумя графическими процессорами, оснащенными достаточным количеством видеопамяти, чтобы обеспечить эффективный вывод. Официальная документация OpenHands: Оценка SWE-Bench с OpenHands SWE-Bench Docker Image. Если вы хотите запустить агент OpenHands с методами масштабирования во время тестирования (метод Best-of-N, основанный на модели критика), обратитесь к блогу за подробными инструкциями. Вам нужно будет переключиться на функцию/llm-критика…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Mungert
Теги: gguf, swe-bench, endpoints_compatible, conversational
Лайков: 5  |  Загрузок: 168

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.