Эта модель представляет собой доработанную версию Qwen/Qwen2-7B-Instruct для набора данных None. В наборе оценок он достигает следующих результатов: — Потеря: 0,5239. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 8e-06 — trainbatchsize: 1 — evalbatchsize: 1 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 4 — Gradientaccumulationsteps: 8 — totaltrainbatchsize: 32 — totalevalbatchsize: 4 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: линейный — lrschedulerwarmupsteps: 100 — num_epochs: 3 — Transformers 4.40.2 — Pytorch 2.2.2+cu121 — Наборы данных 2.19.1 — Токенизаторы 0.19.1
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: shisa-ai
Теги: qwen2, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 5
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.