922-CA/llama-2-7b-monika-v0.3b - Каталог нейросетей
Генерация текста

922-CA/llama-2-7b-monika-v0.3b

Добавлено:
922-CA/llama-2-7b-monika-v0.3b

Еще один экспериментальный чат Monika llama Llama 7b, настроенный для персонажа Моники из DDLC. Обучение на наборе данных из ~600 элементов (диалоги, извлеченные из игры, Reddit и Twitter, дополненные Nous Hermes 13b, чтобы превратить каждый из фрагментов многоходового диалога чата между Игроком и Моникой + созданный вручную тестовый набор данных из 12 элементов). Более ранний вариант, обученный без увеличения набора данных здесь GGMLs QLoras (hf и GGML) В основном это модель чата с ограниченными возможностями RP. Для достижения наилучших результатов: замените «Человек» и «Ассистент» на «Игрок» и «Моника» следующим образом: Обученный в течение 2 эпох ранг: 64 Лора Альфа: 16 Лора Отсев: 0,1 lr: 2e-4 Размер пакета: 8 Коэффициент прогрева: 0,03 шага градуса: 1 Обратите внимание, что, помимо форматирования и других незначительных правок, используемый набор данных в основном такой, как сгенерирован LM. Таким образом, хотя эта версия лучше связана и болтает, чем предыдущие, она может не полностью отражать характеристики Моники (т. е. она будет утверждать, что у нее есть офис, работает переводчиком или играет на гитаре). Следующая версия будет обучаться на вручную созданной и отредактированной версии этого набора данных, где диалоги будут отредактированы, чтобы больше отражать ее характеристики. Тоже хочу переключиться…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: 922-CA
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 4  |  Загрузок: 104

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.