TFMC/Японский-Starling-ChatV-7Bをベースに、ロールプレイ用のデータセットを用いてLoRAでファインチューニングしたモデルです。 Мистральのчат шаблонを利用してください。また、学習に利用したデータのフォーマットの関係上、以下のような形式が望ましいと思われます。また、マルチターンの会話の際には以下の例のようにассистентの各応答の終わりに都度eostoken(`)を入れるようにしてください。 — гримулкан/LimaRP-дополненный — Аратако/Rosebleu-1on1-Dialogues-RP Runpod, графический процессор, A6000x8,習を行いました。主な学習パラメータは以下の通りです。 — lorar: 128 — lisaalpha: 256 — loradropout: 0,05 — loratargetmodules: [«qproj», «kproj», «vproj», «oproj», «gateproj», «upproj», «downproj», «lmhead»] — скорость обучения: 2e-5 — numtrainepochs: 5 эпох — размер пакета: 64 — maxseq_length: 8192
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Aratako
Теги: mistral, not-for-all-audiences, nsfw, ja, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 7
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.