Это Suzume ORPO, обученная ORPO точная настройка многоязычной модели blue/suzume-llama-3-8B с использованием нашего набора данных blue/mitsu. Мы обучили несколько версий этой модели с помощью ORPO и поэтому рекомендуем вам использовать наиболее эффективную модель из наших тестов: blue/suzume-llama-3-8B-multilingual-orpo-borda-half. Обратите внимание, что эта модель имеет некоммерческую лицензию, поскольку мы использовали модели Command R и Command R+ для создания обучающих данных для этой модели (голубой/mitsu). В настоящее время мы работаем над разработкой модели, пригодной для коммерческого использования, так что следите за обновлениями! Мы обучили ORPO следующие модели с использованием различных пропорций набора данных Lightblue/mitsu: Обучение на верхних/нижних ответах всех подсказок в наборе данных: Lightblue/suzume-llama-3-8B-multilingual-orpo-borda-full Обучение на верхних/нижних ответах на подсказки из 75% наиболее последовательно ранжированных ответов в наборе данных: Lightblue/suzume-llama-3-8B-multilingual-orpo-borda-top75 Обучение на верхних/нижних ответах на подсказки 50% наиболее последовательно ранжируемых ответов в наборе данных: светло-синий/suzume-llama-3-8B-multilingual-orpo-borda-half Обучено на верхних/нижних ответах…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: lightblue
Теги: llama, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 8,080
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.