Эта модель представляет собой доработанную версию google/gemma-7b в наборе данных None. Он достигает следующих результатов в наборе оценки: — Потеря: 1,1468 В ходе обучения использовались следующие гиперпараметры: — скорость обучения: 0,0002 — размер партии: 2 — размер партии: 2 — семя: 42 — распределенный тип: мульти-GPU — количество устройств: 4 — шаги градиента накопления: 3 — общий размер партии: 24 — общий размер партии: 8 — оптимизатор: Адам с бета=(0,9,0,999) и эпсилон= 1e-08 — тип lrschedulertype: косинус — lrschedulerwarmupsteps: 48 — количество эпох: 1 — PEFT 0,8,2 — Transfo
Модальности:
Генерация текста
Задача: Генерация текста
Автор: MaziyarPanahi
Теги: tensorboard, gemma, axolotl, generated_from_trainer, 7b, alpaca, peft, lora
Лайков: 3 | Загрузок: 37
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.