Оптимизированная реализация, которая удаляет поведение отказа из Qwen/Qwen2.5-Coder-14B-Instruct), основанное на методах направленного вмешательства. — Осуществляет направленное вмешательство для изменения поведения. — Полностью квантовано для ресурсоэффективного развертывания. На основе результатов исследования «Отказ в LLM опосредован одним направлением».
Модальности:
Генерация текста
Области применения:
Диалог / чат Генерация кода Следование инструкциям
Задача: Генерация текста
Автор: BlossomsAI
Теги: qwen2, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 57
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.