Slush — это двухэтапная модель, обученная с высоким уровнем отсева LoRA, где этап 1 — это продолжение предварительного обучения базовой модели, направленное на повышение творческих способностей модели и ее писательских способностей. Затем это объединяется с моделью настройки инструкций, и этап 2 представляет собой этап тонкой настройки поверх этого для дальнейшего улучшения его ролевых возможностей и / или устранения любого ущерба, причиненного на этапе 1 слияния. Это все еще ранняя стадия. Как всегда, обратная связь приветствуется, и ее можно оставить, если вы требуете совершенства. Второй этап, как и серия Sunfall, следует за пресетом Silly Tavern (ChatML), поэтому ymmv, особенно если вы используете какой-либо другой инструмент и/или пресет. Я провел все свои тесты с temp 1, min-p 0,1, DRY 0,8, но включил XTC по мере роста контекста и/или модели начала говорить «то же самое». Qwen 2.5 32B Instruct (ванильный вариант) имеет сильную тенденцию начинать говорить за пользователя, особенно в сценариях с рассказчиком. Мне не удалось полностью обучить это модели, поэтому вы можете добавить, например. «nYou» в качестве останавливающей строки и включите «обрезать неполные предложения», особенно если у вас есть запрещенные предложения. Модель имеет тенденцию добавлять ненужный заключительный абзац к ответам во время ролевой игры, сортировать…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: crestf411
Теги: qwen2, not-for-all-audiences, mergekit, conversational, text-generation-inference, endpoints_compatible
Лайков: 11 | Загрузок: 5
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.