Эта модель представляет собой доработанную версию google/gemma-2b на наборе данных samvaad-hi-v1. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-05 — trainbatchsize: 4 — evalbatchsize: 8 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 4 -gradientaccumulationsteps: 4 — totaltrainbatchsize: 64 — totalevalbatchsize: 32 — оптимизатор: Адам с betas=(0,9,0,999) и epsilon=1e-08 — lrschedulertype: cosine — numepochs: 1.0 — Transformers 4.39.0.dev0 — Pytorch 2.0.1+cu118 — Наборы данных 2.16.1 — Токенизаторы 0.15.0
Модальности:
Генерация текста
Задача: Генерация текста
Автор: Tensoic
Теги: gemma, full, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 12
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.