Это слияние DARE-TIES Llama3-8b-Instruct + NousResearch/Hermes-2-Pro-Llama-3-8B + aaditya/Llama3-OpenBioLLM-8B. Это простой эксперимент, позволяющий оценить, может ли сочетание моделей с хорошим пониманием языка и биомедицинскими знаниями повысить производительность при выполнении специализированных задач без ущерба для общей применимости. Результаты указывают на многообещающие результаты в таких областях, как задачи HendrycksTest, связанные с биологией и медициной, а также на улучшения в сложном рассуждении, как это видно в тестах ARC Challenge и Winogrande. Я рекомендую использовать шаблон приглашения Llama3: https://llama.meta.com/docs/model-cards-and-prompt-formats/meta-llama-3/ Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. Эта модель была объединена с использованием метода слияния DARE TIES с использованием в качестве основы мета-ламы/Мета-Лламы-3-8B-Instruct. В объединение были включены следующие модели: NousResearch/Hermes-2-Pro-Llama-3-8B aaditya/Llama3-OpenBioLLM-8B Для создания этой модели использовалась следующая конфигурация YAML:
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: lighteternal
Теги: llama, mergekit, merge, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 32
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.