Эта модель представляет собой доработанную версию mistralai/Mistral-7B-v0.1 в наборе данных UltraChat. В оценочном наборе достигаются следующие результаты: — Потеря: 0,9316 — Тип модели: модель GPT с параметрами 7B, точно настроенная на основе общедоступных синтетических наборов данных. — Язык(и) (NLP): преимущественно английский — Лицензия: MIT — Точная настройка на основе модели: mistralai/Mistral-7B-v0.1 — Репозиторий: https://github.com/huggingface/alignment-handbook Модель была точно настроена с помощью 🤗 TRL SFTTrainer на отфильтрованном и предварительно обработанном наборе данных UltraChat, который содержит разнообразный набор синтетических диалогов, созданных ЧатGPT. Вот как можно запустить модель с помощью функции конвейера() из 🤗 Трансформаторов: Во время обучения использовались следующие гиперпараметры: — скорость обучения: 2e-05 — trainbatchsize: 8 — evalbatchsize: 16 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 16 — градиентаккумуляция шагов: 4 — totaltrainbatchsize: 512 — totalevalbatchsize: 256 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupratio: 0.1 — num_epochs: 1 — Трансформаторы 4.34.0 — Pytorch 2.0.1+cu118 — Наборы данных 2.12.0 — Токенизаторы 0.14.0
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: HuggingFaceH4
Теги: tensorboard, mistral, generated_from_trainer, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 112
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.