Эта модель представляет собой экспериментальную тонкую настройку DPO automerger/YamShadow-7B на следующих наборах данных: — mlabonne/truthy-dpo-v0.1 — mlabonne/distilabel-intel-orca-dpo-pairs — mlabonne/chatml-OpenHermes2.5-dpo-binarized-alpha — mlabonne/ultrafeedback-binarized-preferences-cleaned Я понятия не имею, какой шаблон чата лучше всего подходит. Наверное Мистраль-Инструкт или ЧатМЛ.
Модальности:
Генерация текста
Задача: Генерация текста
Автор: mlabonne
Теги: mistral, merge, automerger, text-generation-inference, endpoints_compatible
Лайков: 12 | Загрузок: 88
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.