Эта модель представляет собой точно настроенную версию KnutJaegersberg/Qwen-1_8B-Llamafied на наборе данных None. При обучении использовались следующие гиперпараметры: — скорость обучения: 2e-06 — размер партии: 2 — размер партии: 2 — семя: 42 — распределенный тип: мульти-GPU — количество устройств: 4 — шаги градиентной аккумуляции: 4 — общий размер партии: 32 — размер партии: 8 — оптимизатор: Адам с бета=(0,9,0,999) и эпсилон= 1e-08 — тип lrschedulertype: косинус — lrschedulerwarmupsteps: 100 — количество эпох: 1 — Трансформаторы 4.34.1 — Pytorch 2.0.1 cu118 — Наборы данных 2.14.6 — Tokenizers 0.14.1
Модальности:
Генерация текста
Задача: Генерация текста
Автор: qnguyen3
Теги: llama, generated_from_trainer, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 14
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.