nandukmelath/Qwen3.5-9B-Uncensored-nothink-GGUF - Каталог нейросетей
Генерация текста

nandukmelath/Qwen3.5-9B-Uncensored-nothink-GGUF

Добавлено:
nandukmelath/Qwen3.5-9B-Uncensored-nothink-GGUF

Это исправленный GGUF HauhauCS/Qwen3.5-9B-Uncensored-HauhauCS-Aggressive с одним ключевым изменением: мышление отключено на уровне шаблона GGUF, что дает вам мгновенные ответы без задержки рассуждения в 15–30 секунд. Qwen3.5 — это модель мышления. По умолчанию он выводит блок … перед каждым ответом. Это отлично подходит для сложных задач, но жестоко для повседневного использования — вы ждете 20 секунд, чтобы получить простой ответ. Эта модель исправляет встроенный шаблон чата Jinja2, чтобы всегда выводить пустой мыслительный блок: интеллект модели закодирован в ее весах, а не в следе мышления. Качество такое же. Скорость в 25 раз выше по времени до первого токена. > Хотите рассуждений по требованию? Добавьте /think к любому сообщению — модель полностью обдумает его только в этом ходу. 1. Загрузите файл Q4KM ниже 2. Загрузите в LM Studio с —context-length 65536 —gpu max 3. Готово — конфигурация не требуется, мышление уже исправлено Одна команда: повышение VRAM + автозапуск + загрузка модели + конфигурация агента Hermes: Qwen3.5 GGUF содержит встроенный шаблон чата Jinja2 с этим блоком: тот же размер файла (дополненный пробелами), та же структура, нулевые накладные расходы на размышления. Скрипт патчера имеет открытый исходный код: patch_nothink.py — Base…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: nandukmelath
Теги: gguf, uncensored, qwen3, local-llm, no-think, apple-silicon, lm-studio, zero-guardrail
Лайков: 7  |  Загрузок: 2,334

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.