Эта модель лучше всего работает с ролевыми играми в интернет-стиле, используя стандартную разметку со звездочками вокруг действий и без кавычек вокруг диалогов. Текущая работа направлена на создание специального набора данных DPO, а также на расширение обучающих данных, чтобы включить в них больше нишевых интересов. Набор данных Pure-Dove Claude Multiround 30k OpenOrcaSlim Дополнительный набор данных DPO был создан с использованием нескольких общих наборов данных, доступных на Hugging Face.
Модальности:
Генерация текста
Задача: Генерация текста
Автор: cgato
Теги: llama, not-for-all-audiences, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 9
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.