Эта модель представляет собой доработку MaziyarPanahi/calme-2.4-rys-78b для 1,5 тыс. строк набора данных mlabonne/orpo-dpo-mix-40k. Он был обучен как универсальная языковая модель для различных вариантов использования генерации текста, включая поддержку агентских возможностей, ролевые игры, рассуждения, многоходовые разговоры, согласованность длительного контекста и многое другое. По состоянию на октябрь 2024 года это первая модель в таблице лидеров Open LLM 🏆. Благодарим mlabonne, MaziyarPanahi и других. для исходного набора данных и базовой модели. С экспериментом на W&B можно ознакомиться по этой ссылке. Вот несколько визуализаций:
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: dfurman
Теги: qwen2, orpo, sft, chatml, conversational, en, model-index, text-generation-inference
Лайков: 79 | Загрузок: 27
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.