Модель специалиста по ролевым играм и написанию историй, полнопараметрическая точная настройка Qwen2.5-32B на смеси синтетических и естественных данных. Он использует смесь данных Celeste 70B 0,1, значительно расширяя ее для улучшения универсальности, креативности и «ароматности» получаемой модели. Примечания к версии 0.2: По сути, весь набор данных был повторно обработан из-за серьезной ошибки в ранее использованном конвейере, из-за которой данные были отравлены большим количеством символов, не относящихся к Юникоду. Теперь больше нет странных артефактов генерации и больше стабильности. Огромное спасибо Кахвею за его работу по устранению этой критической проблемы. Формат запроса — ChatML. Рекомендуемые значения сэмплера: Температура: 1 Min-P: 0,05 Top-A: 0,2 Штраф за повторение: 1,03 Рекомендуемые пресеты SillyTavern (через CalamitousFelicitousness): Данные обучения: смесь данных Celeste 70B 0,1 минус подмножество Opus Instruct. Подробности смотрите на карточке этой модели. Набор данных OpusInstruct25k Каломазе, отфильтрованный на предмет отказов. Подмножество (1 тыс. строк) ChatGPT-4o-WritingPrompts от Gryphe. Подмножество (2 тыс. строк) наборов данных Sonnet3.5-Charcards-Roleplay от Gryphe Synthstruct и SynthRP от Epiculous. Подмножество из Dolphin-2.9.3, включая отфильтрованную версию not_samantha и небольшое подмножество systemchat. Обучение…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: EVA-UNIT-01
Теги: qwen2, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 58 | Загрузок: 130
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.