TianPeng — это модель чата, настроенная с использованием LoRA поверх модели LLaMA-30B. Учебный корпус включает в себя английский и китайский языки. Базовая модель: LLaMA-30B Training Эпоха: 1 Размер пакета: 40 Максимальная длина ввода: 2048 Скорость обучения: 5e-5 Ранг LoRA: 8 Обновленные модули: Все линейные элементы Шаги: 30091 >建议直接使用Baize-chatbot/demo作为WebUI进行部署,它适用于所有基于PEFT训练的LLaMA LoRA权重。 — alpaca.en.json, quora.en.json и stackoverflow.en.json извлечены из BaiZe, выпущенного под лицензией GPL-3.0, авторами являются Сюй, Канвен и Го, Дайя и Дуан, Нан и Маколи, Джулиан. — «guanaco.json» и guanaco-paper-ответы.json извлечены из набора данных GuanacoDataset. — «translation2019.json» извлечены из nlpchinesecorpus. — «belle1m.cn.json» извлечены из набора данных BelleGroup. — «unnaturalinstructiongpt4.en.json» извлечены из инструкции по настройке с помощью GPT-4. Эта модель предназначена только для академических исследовательских целей. Согласно лицензии LLaMA, вы не должны использовать эту модель в коммерческих целях. «`bibtex @misc{tianpeng,author = {Ли, Дин и Сянь, Чжан}, title = {TianPeng: тонко настроенная китайская модель чата…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: pleisto
Теги: LLaMA, LoRA, zh, en
Лайков: 7 | Загрузок: 0
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.