Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. DeepSeek-R1-Distill-Llama-8B был объединен с небольшим весом в надежде повысить логические способности полученной модели. Эта модель была объединена с использованием метода арифметического слияния задач с использованием в качестве основы мета-ламы/Llama-3.1-8B. В слияние были включены следующие модели: grimjim/SauerHuatuoSkywork-o1-Llama-3.1-8B deepseek-ai/DeepSeek-R1-Distill-Llama-8B Для создания этой модели была использована следующая конфигурация YAML: Подробные результаты можно найти здесь! Обобщенные результаты можно посмотреть здесь!
Модальности:
Генерация текста
Задача: Генерация текста
Автор: grimjim
Теги: llama, mergekit, merge, model-index, text-generation-inference, endpoints_compatible
Лайков: 7 | Загрузок: 10
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.