Эта модель представляет собой версию mistralai/Mistral-7B-v0.1 с полными параметрами и точными настройками, обученную на наборе данных Neural-DPO, Metamathgsm8k и RPGPTPublicDomain-alpaca. Эта модель превосходно справляется с ролью персонажей, а также способна точно отвечать на широкий спектр сложных вопросов. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-06 — trainbatchsize: 2 — evalbatchsize: 2 — начальное число: 42 -gradientaccumulationsteps: 4 — totaltrainbatchsize: 8 — оптимизатор: Адам с betas=(0.9,0.999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupsteps: 10 – числовых интервалов: 1 — Трансформеры 4.38.0.dev0 — Pytorch 2.2.0+cu121 — Наборы данных 2.17.1 — Токенизаторы 0.15.0.
Модальности:
Генерация текста
Задача: Генерация текста
Автор: NeuralNovel
Теги: mistral, generated_from_trainer, text-generation-inference, endpoints_compatible
Лайков: 6 | Загрузок: 11
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.