This model is a fine-tuned version of BlouseJury/Mistral-7B-Discord-0.1 on the Intel/orcadpopairs dataset. It achieves the following results on the evaluation set: — Loss: 0.7923 The following hyperparameters were used during training: — learningrate: 5e-06 — trainbatchsize: 2 — evalbatchsize: 2 — seed: 42 — gradientaccumulationsteps: 4 — totaltrainbatchsize: 8 — optimizer: Adam with betas=(0.9,0.999) and epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupsteps: 10 — numepochs: 1 — Transformers 4.37.0 — Pytorch 2.1.2+cu121 — Datasets 2.16.1 — Tokenizers 0.15.0
Модальности:
Генерация текста
Задача: Генерация текста
Автор: BlouseJury
Теги: mistral, generated_from_trainer, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 20
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.