Aratako/calm3-22b-RP-v2 - Каталог нейросетей
Генерация текста

Aratako/calm3-22b-RP-v2

Добавлено:
Aratako/calm3-22b-RP-v2

киберагент/calm3-22b-chatをベースにロールプレイ用にQLoRAでファインチューニングしたモデルです。 — Аратако/Rosebleu-1on1-Dialogues-RP — Aratako/Synthetic-Japanese-Roleplay-NSFW-Claude-3.5s-15.3k-formatted — Aratako/Synthetic-Japanese-Roleplay-gpt-4o-mini-39.6k-formated — grimulkan/LimaRP-augmented — SicariusSicariiStuff/BluemoonTop50MBSortedFixed — MinervaAI/Aesir-Preview — openerotica/freedom-rp — openerotica/lima-nsfw — Chaser-cz/roleplayscripts — roleplay4fun/aesir-v1.1 Unsloth, QLoRA, Runpod, A40,枚で学習を行いました。主な学習パラメータは以下の通りです。 — lorar: 128 — lisaalpha: 256 — loradropout: 0 — loratargetmodules: [«qproj», «kproj», «vproj», «oproj», «gateproj», «upproj», «downproj»] — скорость обучения: 2e-5 — numtrainepochs: 2 — размер пакета: 64 — maxseqlength: 8192 — Weightdecay: 0.01 — коэффициент разогрева: 0.05 Сонетの出力が含まれるため、これらの競合となるサービスには本モデルは利用できません。そのため、本モデルはCC-BY-NC-SA 4.0の元配布します。 — Разработчик: Aratako — Лицензия: cc-by-nc-sa-4.0 — Точная настройка на основе модели: cyberagent/calm3-22b-chat Эта модель ламы была обучена В 2 раза быстрее с библиотекой TRL от Unsloth и Huggingface.

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Aratako
Теги: llama, text-generation-inference, unsloth, trl, sft, conversational, ja, endpoints_compatible
Лайков: 20  |  Загрузок: 16

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.