This model is a fine-tuned version of HuggingFaceTB/SmolLM-360M-Instruct on the None dataset. It achieves the following results on the evaluation set: — Loss: 1.1516 The following hyperparameters were used during training: — learningrate: 2e-05 — trainbatchsize: 6 — evalbatchsize: 6 — seed: 42 — distributedtype: multi-GPU — numdevices: 2 — gradientaccumulationsteps: 8 — totaltrainbatchsize: 96 — totalevalbatchsize: 12 — optimizer: Adam with betas=(0.9,0.999) and epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupsteps: 100 — num_epochs: 1 — Transformers 4.42.3
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: CarrotAI
Теги: llama, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 20
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.