Эта модель представляет собой доработанную версию /root/autodl-tmp/sikong/repo/LMFlow/output_models/Linly-Chinese-LLaMA-7b-hf для настроенного набора данных. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 2e-05 — trainbatchsize: 2 — evalbatchsize: 8 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 4 — totaltrainbatchsize: 8 — totalevalbatchsize: 32 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: линейный — количество эпох: 50.0 — Трансформаторы 4.28.0.dev0 — Pytorch 2.0.0+cu117 — Наборы данных 2.10.1 — Токенизаторы 0.13.3
Модальности:
Генерация текста
Задача: Генерация текста
Автор: SikongSphere
Теги: llama, generated_from_trainer, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 7
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.