Если вы считаете эту модель полезной, поставьте ей лайк и отметьте нас на https://github.com/LianjiaTech/BELLE! Эта модель получена путем точной настройки всех параметров с использованием данных китайских инструкций 0,4M на оригинальном чате Llama2-13B. Мы твердо убеждены, что оригинальный чат Llama2 демонстрирует похвальную производительность после контролируемой точной настройки (SFT) и обучения с подкреплением с обратной связью от человека (RLHF). Нашей целью по-прежнему является дальнейшее совершенствование этой модели с использованием учебных данных на китайском языке для точной настройки, стремясь обеспечить стабильный и высококачественный результат на китайском языке. Обратите внимание, что входные данные должны быть отформатированы следующим образом как при обучении, так и при выводе. После расшифровки файлов BELLE-Llama2-13B-chat-0.4M можно легко загрузить с помощью AutoModelForCausalLM. В модели, обученной на текущей базовой модели и данных, все еще существует несколько проблем: 1. Модель может генерировать фактические ошибки, когда ее просят следовать инструкциям, связанным с фактами. 2. Иногда генерирует вредоносные ответы, поскольку модель все еще не может идентифицировать потенциально вредоносные инструкции. Поскольку модель по-прежнему имеет свои ограничения, мы требуем, чтобы разработчики использовали только код с открытым исходным кодом…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: BELLE-2
Теги: llama, text2text-generation, zh, en, text-generation-inference, endpoints_compatible
Лайков: 31 | Загрузок: 1,068
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.