> [!NOTE] > Все кванты GGUF (Q3/Q4/Q5/Q6/Q8) проверены на работе в llama.cpp/Ollama. Более ранняя загрузка ссылалась на неиспользуемый уровень прогнозирования нескольких токенов (MTP), и ее не удалось загрузить; это была проблема только с метаданными, и она была исправлена для всех файлов. На вес и качество модели это не повлияло. Удаленная (без цензуры) версия Jackrong/Qwopus3.6-27B-Coder, созданная с помощью Heretic v1.4.0 — полностью автоматическая направленная абляция на основе оптимизации. Никакого переобучения, никакой ручной настройки. Базой является модель агентного кодирования/использования инструментов, построенная на гибридной архитектуре SSM-внимания Qwen3.5. В этой версии устранено большинство отказов, сохраняя при этом возможности практически нетронутыми. Heretic провел 200 испытаний Optuna, совместно оптимизируя подавление отказа против отклонения KL от исходной модели. Выбранная конфигурация (испытание 67): устранено 96% отказов, при этом расхождение KL ~ в 40 раз ниже порога 0,5, что указывает на значительный ущерб возможностям. На практике кодирование и рассуждения базовой модели сохраняются. Безопасные датчики полной точности (BF16) плюс ряд квантований GGUF для llama.cpp/Ollama: > Сборки GGUF содержат только текстовую модель (башня визуализации не…
Модальности:
Генерация текста
Области применения:
Генерация кода Диалог / чат
Задача: Генерация текста
Автор: 8sp4rk
Теги: gguf, qwen3_5, image-text-to-text, heretic, abliterated, uncensored, code, conversational
Лайков: 5 | Загрузок: 843
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.