sbintuitions/sarashina2.1-1bを手元のデータでInstruction Tuningしたモデルです。 Сарашина лицензируется в соответствии с Модельным некоммерческим лицензионным соглашением Сарашины, авторские права ©SB Intuitions Corp. Все права защищены. 元モデルからМодель Сарашина Некоммерческая лицензия Соглашение.本モデルの製作者は元モデルの製作者であるSB Интуиция 株式会社とは一切関係ありません。本モデルに何か問題があった場合は製作者である私宛にご連絡ください。 Эта модель представляет собой доработанную версию sbintuitions/sarashina2.1-1b для набора данных None. В наборе оценок он достигает следующих результатов: — Потеря: 0,9366. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 2e-05 — trainbatchsize: 8 — evalbatchsize: 1 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 8 -gradientaccumulationsteps: 4 — totaltrainbatchsize: 256 — totalevalbatchsize: 8 — оптимизатор: Используйте OptimizerNames.ADAMWTORCH с betas=(0.9,0.999) и epsilon=1e-08 иOptimrargs=No дополнительных аргументов оптимизатора — lrschedulertype: cosine — lrschedulerwarmupsteps: 20 — num_epochs: 2 — Transformers 4.46.3 — Pytorch 2.3.1+cu121 — Наборы данных 3.1.0 — Токенизаторы 0.20.3
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Aratako
Теги: llama, axolotl, generated_from_trainer, conversational, ja, text-generation-inference, endpoints_compatible
Лайков: 15 | Загрузок: 434
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.