Эта модель карты представляет собой версию модели upstage/SOLAR-10.7B-Instruct-v1.0 с доработанными инструкциями. Прошел обучение на наборе данных Intel DPO Orca с использованием LoRA. Хотя следует отметить, что в документе SOLAR-10.7B говорится, что исходная модель выравнивания была обучена на парах Intel ORCA DPO. Переобучение с использованием DPO и LoRA незначительно ( Чтобы использовать модель bhavinjawade/SOLAR-10B-OrcaDPO-Jawade, выполните следующие действия: 1. Импортируйте и загрузите модель и токенизатор. Начните с импорта модели и токенизатора. Загрузите их с помощью метода frompretrained`. 2. Отформатируйте приглашение. Отформатируйте входные данные чата как список сообщений, каждое из которых имеет роль («система» или «пользователь») и контент. 3. Создайте Конвейер Настройте конвейер для генерации текста с загруженной моделью и токенизатором. 4. Генерация текста. Используйте конвейер для генерации последовательности текста на основе запроса. Вы можете настроить такие параметры, как температура и top_p, для разных стилей ответов. Эта настройка позволяет использовать возможности модели bhavinjawade/SOLAR-10B-OrcaDPO-Jawade для генерации ответов на входные данные в чате. и распространение как для частных, так и для коммерческих целей на условиях…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: bhavinjawade
Теги: llama, conversational, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 50
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.