Новое объединение моделей на основе NeMo, к счастью, на этот раз с форматом ChatML. Моей целью было создать умную и универсальную модель ролевой игры, стабильную в более высоких контекстах. Пока это кажется лучше, чем мои лучшие попытки Nemomix, особенно в контексте 64k+, который я использовал. Вся благодарность и благодарность выражаются замечательным Gryphe, MistralAI, Anthracite, Sao10K и ShuttleAI за их потрясающие модели. ChatML, но Mistral Instruct тоже должны работать (теоретически). Я рекомендую использовать температуру 1,0-1,2 с 0,1 Top A или 0,01-0,1 Min P и с 0,8/1,75/2/0 DRY. Также работает при более низких температурах ниже 1,0. Больше ничего не нужно. Вы можете использовать мои точные настройки отсюда (используйте те, которые находятся в папке ChatML Base/Customized): https://huggingface.co/MarinaraSpaghetti/SillyTavern-Settings/tree/main. Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. Эта модель была объединена с использованием метода слияния della_linear с использованием F:mergekitmistralaiMistral-Nemo-Base-2407 в качестве основы. В слияние были включены следующие модели: F:mergekitmistralaiMistral-Nemo-Instruct-2407 F:mergekitGryphePantheon-RP-1.5-12b-Nemo F:mergekitshuttleaishuttle-2.5-mini F:mergekitSao10KMN-12B-Lyra-v1 …
Модальности:
Генерация текста
Задача: Генерация текста
Автор: MarinaraSpaghetti
Теги: mistral, mergekit, merge, text-generation-inference, endpoints_compatible
Лайков: 34 | Загрузок: 14
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.