Эта модель представляет собой доработанную версию мета-ламы/Мета-Лламы-3-8B в наборе данных kobprof/skolegpt-instruct. В наборе оценок он достигает следующих результатов: — Потеря: 0,9477. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 2e-05 — trainbatchsize: 1 — evalbatchsize: 1 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 4 — totaltrainbatchsize: 4 — totalevalbatchsize: 4 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupratio: 0,2 — num_epochs: 1 — Transformers 4.41.0.dev0 — Pytorch 2.2.0 — Наборы данных 2.19.0 — Токенизаторы 0.19.1
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: emillykkejensen
Теги: llama, trl, sft, generated_from_trainer, danish, conversational, da, text-generation-inference
Лайков: 5 | Загрузок: 14
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.