Во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-06 — trainbatchsize: 1 — evalbatchsize: 8 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 4 -gradientaccumulationsteps: 16 — totaltrainbatchsize: 64 — totalevalbatchsize: 32 — оптимизатор: используйте OptimizerNames.ADAMWTORCH с betas=(0.9,0.999) и epsilon=1e-08 иOptimargs=Нет дополнительных аргументов оптимизатора — lrschedulertype: cosine — lrschedulerwarmupratio: 0,1 — num_epochs: 1.0 — Transformers 4.52.4 — Pytorch 2.6.0+cu124 — Наборы данных 3.6.0 — Токенизаторы 0.21.1
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: yellowtown
Теги: qwen2, llama-factory, full, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 11
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.