Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. Эта модель была объединена с использованием метода слияния SLERP. (градиент софосимпатии) Следующие модели были включены в слияние: v000000/Qwen2.5-14B-Gutenberg-1e-Delta Qwen/Qwen2.5-14B-Instruct Для создания этой модели использовалась следующая конфигурация YAML: Идея здесь заключается в том, что Gutenberg DPO остается на выходе/входе на 100%, плавно объединяясь с базовой моделью инструкций на более глубоких уровнях для устранения потерь и увеличения интеллект.
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: v000000
Теги: qwen2, mergekit, merge, qwen2.5, dpo, conversational, model-index, text-generation-inference
Лайков: 7 | Загрузок: 36
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.