A Mistral 7B LLM built from merging pretrained models and finetuning on Jon Durbin’s Gutenberg DPO set. Flammen specializes in exceptional character roleplay, creative writing, and general intelligence Finetuned using an A100 on Google Colab. (plz give more gpu) Fine-tune a Mistral-7b model with Direct Preference Optimization — Maxime Labonne
Модальности:
Генерация текста
Задача: Генерация текста
Автор: flammenai
Теги: mistral, model-index, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 34
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.