Эта модель представляет собой точно настроенную версию meta-llama/Meta-Llama-3.1-8B на наборе данных Magpie-Align/MagpieLM-SFT-Data-v0.1. Это промежуточная контрольная точка для тонкой настройки Magpie-Align/MagpieLM-8B-Chat-v0.1. При обучении использовались следующие гиперпараметры: — скорость обучения: 2e-05 — размер партии: 1 — размер партии: 1 — семя: 42 — распределенный тип: мульти-GPU — количество устройств: 4 — этапы градиентной аккумуляции: 32 — общий размер партии: 128 — общий размер партии: 4 — оптимизатор: Адам с бета=(0,9,0,999) и эпсилон= 1e-08 — тип lrschedulertype: косинус — lrschedulerwarmupsteps: 51 — количество эпох: 2 — Трансформаторы 4.45.0.dev0 — Pytorch 2.3.0 cu121 — Наборы данных 2.19.1 — Tokenizers 0.19.1
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Magpie-Align
Теги: llama, axolotl, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 53
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.