Это версия Qwen/Qwen-7B-Chat с поддержкой LLaMA, перекалиброванная для соответствия исходной структуре модели, подобной LLaMA/LLaMA-2. Вы можете использовать LlamaForCausalLM для вывода модели, которая аналогична моделям LLaMA/LLaMA-2. Я преобразовал токенайзер из формата tiktoken в форматhuggingface, поэтому вам больше не нужно разрешать внешние коды при загрузке. Модель была отредактирована и теперь имеет белую маркировку, что означает, что модель больше не будет называть себя Qwen. СПОЙЛОР: Идет дальнейшая доработка, текущая версия находится в стадии разработки, некоторые знания могут быть предвзятыми и иллюзорными из-за структурных изменений. Будет обновляться очень, очень оооооооооооооо. Проблема: по сравнению с исходной оценкой Qwen-Chat 53,9, оценка MMLU немного снизилась (-3,54) из-за недостаточной перестройки.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: vonjack
Теги: llama, qwen, llama-2, en, zh, text-generation-inference, endpoints_compatible
Лайков: 24 | Загрузок: 1,082
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.