Модель специалиста по ролевой игре и написанию историй, полнопараметрическая точная настройка Qwen2.5-72B на смеси синтетических и естественных данных. Он использует смесь данных Celeste 70B 0,1, значительно расширяя ее для улучшения универсальности, креативности и «ароматности» получаемой модели. Рекомендуемые пресеты SillyTavern (через CalamitousFelicitousness): Данные обучения: смесь данных Celeste 70B 0,1 минус подмножество Opus Instruct. Подробности смотрите на карточке этой модели. Набор данных OpusInstruct25k Каломазе, отфильтрованный на предмет отказов. Подмножество (1 тыс. строк) наборов данных ChatGPT-4o-WritingPrompts от Gryphe. Подмножество (2 тыс. строк) наборов данных Sonnet3.5-Charcards-Roleplay от Gryphe Synthstruct и SynthRP от Epiculous. Время обучения и аппаратное обеспечение: 12 часов на 8xMI300X. Модель была обучена Кирмом и Аури. Особая благодарность: Gryphe, Lemmy, Kalomaze, Nopm и Epiculous за данные, CalamitiousFelicitousness за предоставление бесплатных выводов для публичного бета-тестирования и Allura-org за поддержку и отзывы о моделях EVA. Посмотреть конфигурацию аксолотля
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: EVA-UNIT-01
Теги: qwen2, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 10
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.