Модель обучена с помощью инновационного метода ORPO, основанного на надежной среде VAGOsolutions/SauerkrautLM-Phi-3. Модель была обучена с использованием набора данных: mlabonne/orpo-dpo-mix-40k, который объединяет различные источники данных для улучшения разговорных способностей и контекстуального понимания.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Danielbrdz
Теги: mistral, ORPO, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 8,260
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.