В этой модели мышление по умолчанию отключено с помощью модифицированного файла шаблона чата, записанного в gguf. Если вы хотите включить мышление, установите для переменной: {%- установите Enable_thinking = False %} значение True в шаблоне чата. Я извлек тензоры без цензуры, созданные HauhauCS, с помощью этого скрипта: https://pastebin.com/1qKgR3za и объединил их с дистиллированной контрольной точкой Jackrong. Для наилучшей производительности модели используйте следующие настройки в LM Studio: > Обновление: > Эта модель была дополнительно улучшена за счет дополнительных данных рассуждений, извлеченных из Qwen3.5-27B. > > Новые данные обучения представляют более качественные траектории рассуждения в таких областях, как естествознание, выполнение инструкций и математика. > > Часть данных взята из Jackrong/Qwen3.5-reasoning-700x, курируемого набора данных, предназначенного для улучшения структурированного пошагового рассуждения и разнообразия рассуждений. Qwen3.5-9B-Claude-4.6-Opus-Reasoning-Distilled — это высокоэффективная модель рассуждения, настроенная на основе плотной архитектуры Qwen3.5-9B. Основная директива модели заключается в использовании современной дистилляции цепочки мыслей (CoT), в первую очередь полученной из взаимодействий Claude-4.6 Opus. С помощью контролируемой точной настройки (SFT), уделяя особое внимание структурированному рассуждению…
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: LuffyTheFox
Теги: gguf, qwen3_5, unsloth, qwen, qwen3.5, reasoning, chain-of-thought, lora
Лайков: 72 | Загрузок: 25,135
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.