Эта модель представляет собой доработанную версию nvidia/Llama-3.1-Minitron-4B-Width-Base на наборе данных Magpie-Align/MagpieLM-SFT-Data-v0.1. Это промежуточная контрольная точка для тонкой настройки Magpie-Align/MagpieLM-4B-Chat-v0.1. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 2e-05 — trainbatchsize: 1 — evalbatchsize: 1 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 4 -gradientaccumulationsteps: 32 — totaltrainbatchsize: 128 — totalevalbatchsize: 4 — оптимизатор: Адам с betas=(0,9,0,999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupsteps: 51 — num_epochs: 2 — Transformers 4.45.0.dev0 — Pytorch 2.3.0+cu121 — Наборы данных 2.19.1 — Токенизаторы 0.19.1
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Magpie-Align
Теги: llama, axolotl, generated_from_trainer, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 5
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.