bigatuna/Qwen3.5-9b-Sushi-Coder-RL-GGUF - Каталог нейросетей
Генерация текста

bigatuna/Qwen3.5-9b-Sushi-Coder-RL-GGUF

Добавлено:
bigatuna/Qwen3.5-9b-Sushi-Coder-RL-GGUF

— Родословная базовой модели: bigatuna/Qwen3.5-9b-Sushi-Coder — Модель RL: bigatuna/Qwen3.5-9b-Sushi-Coder-RL — Конвейер RL: NousResearch/atropos — nohurry/Opus-4.6-Reasoning-3000x-filtered — open-r1/codeforces-cots Затем был запущен этап RL для кодирования с помощью NousResearch/hermes-agent с использованием NousResearch/atropos. Во время этого запуска vLLM был исправлен с помощью vllm-project/vllm PR # 36395, fix(lora): добавить проверку границ для конфигураций TP, чтобы решить проблему тензорно-параллельных границ LoRA. — Qwen3.5-9b-Sushi-Coder-RL.Q4KM.gguf — Qwen3.5-9b-Sushi-Coder-RL.Q80.gguf — Qwen3.5-9b-Sushi-Coder-RL.BF16-mmproj.gguf` Это мультимодальный экспорт Qwen 3.5. Используйте текст GGUF вместе с файлом BF16-mmproj. — Лицензия: Apache-2.0 — Архитектура: Qwen 3.5 — Формат: GGUF — Теги: llama.cpp, qwen35, multimodal, code, rl, разговорный` Приведенные ниже результаты тестов были получены на основе совпадающих локальных конечных точек BF16 vLLM, поэтому модель RL и базовая модель оценивались с использованием одного и того же метода обслуживания, одной и той же задачи и одинаковых настроек генерации. — Модель RL: bigatuna/Qwen3.5-9b-Sushi-Coder-RL — Базовая модель: Qwen/Qwen3.5-9B — Задача: lcb:codegeneration|0 — Размер эталонного теста: 268 проблем — Серверная часть: облегченная конечная точка Litellm…

Модальности:
Генерация текста Мультимодальность

Области применения:
Генерация кода Диалог / чат


Задача: Генерация текста
Автор: bigatuna
Теги: gguf, llama.cpp, qwen3_5, code, rl, atropos, multimodal, en
Лайков: 33  |  Загрузок: 10,508

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.