Эта модель представляет собой доработанную версию Qwen/Qwen1.5-1.8B в наборе данных HuggingFaceH4/deita-6k-v0-sft. В наборе оценок он достигает следующих результатов: — Потеря: 1,0886. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 2e-05 — trainbatchsize: 16 — evalbatchsize: 8 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 8 — totaltrainbatchsize: 128 — totalevalbatchsize: 64 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupratio: 0,1 — num_epochs: 3 — Трансформаторы 4.38.2 — Pytorch 2.1.2+cu121 — Наборы данных 2.16.1 — Токенизаторы 0.15.1
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: trl-lib
Теги: tensorboard, qwen2, alignment-handbook, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 14
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.