robinsmits/Qwen1.5-7B-Dutch-Chat - Каталог нейросетей
Генерация текста

robinsmits/Qwen1.5-7B-Dutch-Chat

Добавлено:
robinsmits/Qwen1.5-7B-Dutch-Chat

Эта модель, совместимая с DPO, представляет собой объединенную версию модели адаптера roinsmits/Qwen1.5-7B-Dutch-Chat-Dpo. Точная настройка DPO была выполнена на голландском наборе данных BramVanroy/ultrafeedbackdutch_cleaned. См. Qwen/Qwen1.5-7B-Chat для получения всей информации о базовой модели. Результаты оценки на голландском языке можно посмотреть на сайте ScandEval. Эта модель достигает оценки, очень близкой к производительности GPT-3,5. Обратите внимание, что эти результаты оценки относятся к английскому языку. Как и все LLM, эта модель также может испытывать предвзятость и галлюцинации. Независимо от того, как вы используете эту модель, всегда выполняйте необходимое тестирование и проверку. Учебный блокнот доступен по следующей ссылке: Qwen157BDutchChat_DPO Обучение проводилось с помощью Google Colab PRO на A100 — 40 ГБ и длилось около 4 часов. Он достигает следующих результатов в наборе оценок: — Потеря: 0,2610 — Награды/выбрано: -0,7248 — Награды/отклонено: -2,6224 — Награды/точность: 0,9170 — Награды/прибыль: 1,8976 — Журналы/отклонено: -877,8102 — Журналы/выбраны: -783,4282 — Логит/отклонено: -0,8110 — Логит/выбрано: -0,7528 Во время обучения использовались следующие гиперпараметры: — скорость обучения: 1e-05…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: robinsmits
Теги: qwen2, trl, dpo, conversational, nl, model-index, text-generation-inference
Лайков: 5  |  Загрузок: 70

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.