danielcherubini/Qwen3.5-DeltaCoder-9B-GGUF - Каталог нейросетей
Генерация текста

danielcherubini/Qwen3.5-DeltaCoder-9B-GGUF

Добавлено:
danielcherubini/Qwen3.5-DeltaCoder-9B-GGUF

> v1.1-DPO — теперь с выравниванием DPO для улучшения правильности кода и самопроверки. > Если вы загрузили версию до 28 марта 2026 г., повторите попытку, чтобы получить версию 1.1-DPO. Квантование GGUF Qwen3.5-DeltaCoder-9B для использования с llama.cpp, Ollama, LM Studio и другими механизмами вывода, совместимыми с GGUF. — Выравнивание DPO для 4519 пар предпочтений из AceCode-V2-122K. — Самокорректирующееся поведение — модель теперь обнаруживает и исправляет свои собственные ошибки, а не отправляет неверный код. — Улучшенная корректность кода — обучение отдает предпочтение проходящим решениям, а не неудачным. Q6K — Большой объем видеопамяти (16 ГБ+): Q80 — Полная точность: BF16 > [!ВНИМАНИЕ] > Не используйте температуру ниже 0,5 — низкие температуры вызывают детерминированное зацикливание при многооборотном агентном использовании. *Версия 1.1-DPO истекла по тайм-ауту для двух задач, на которые версия 1 ответила неправильно — подтверждено улучшение поведения, работает с увеличенным тайм-аутом. — Unsloth для поддержки обучения Qwen3.5 — Together AI для набора данных CoderForge — TIGER Lab для AceCode-V2-122K — Jackrong для дистилляции рассуждений — Qwen для базовой модели

Модальности:
Генерация текста

Области применения:
Генерация кода Логика и рассуждение Диалог / чат


Задача: Генерация текста
Автор: danielcherubini
Теги: gguf, qwen3.5, code, tool-calling, quantized, reasoning, chain-of-thought, dpo
Лайков: 15  |  Загрузок: 2,887

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.