Gemma-2-9b-it-TR-DPO-V1 — это усовершенствованная версия gemma-2-9b-it. Он обучается на наборе данных предпочтений, который генерируется синтетически. — Базовая модель: gemma-2-9b-it — Данные для обучения: использовался синтетически сгенерированный набор данных о предпочтениях, состоящий из 10 тысяч выборок. Никакие собственные данные не использовались. — Время обучения: 2 часа на одном NVIDIA H100 — Конфигурации QLoRA: — lorar: 64 — loraalpha: 32 — loradropout: 0,05 — loratarget_linear: true Целью была тонкая настройка модели для улучшения выходного формата и качества контента для турецкого языка. Он не обязательно умнее базовой модели, но его характеристики более привлекательны и предпочтительны. По сравнению с базовой моделью, Gemma-2-9b-it-TR-DPO-V1 более бегло и связно говорит на турецком языке. Он может генерировать более информативные и подробные ответы на данную инструкцию. Следует отметить, что модель по-прежнему будет генерировать неправильные или бессмысленные выходные данные, поэтому проверьте выходные данные перед их использованием. — MMLUTRV0.2: 51,69% — TruthfulQATRV0.2: 54,72% — ARCTRV0.2: 52,82% — HellaSwagTRV0.2: 51,16% — GSM8KTRV0.2: 65,07% — WinograndeTRV0.2: 55,29% — Среднее**: 55,13% Эти оценки могут отличаться от тех, которые вы получите при выполнении тех же тестов, поскольку…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Metin
Теги: gemma2, conversational, tr, model-index
Лайков: 15 | Загрузок: 57
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.