lighteternal/Llama3-merge-biomed-8b - Каталог нейросетей
Генерация текста

lighteternal/Llama3-merge-biomed-8b

Добавлено:

Это слияние DARE-TIES Llama3-8b-Instruct + NousResearch/Hermes-2-Pro-Llama-3-8B + aaditya/Llama3-OpenBioLLM-8B. Это простой эксперимент, позволяющий оценить, может ли сочетание моделей с хорошим пониманием языка и биомедицинскими знаниями повысить производительность при выполнении специализированных задач без ущерба для общей применимости. Результаты указывают на многообещающие результаты в таких областях, как задачи HendrycksTest, связанные с биологией и медициной, а также на улучшения в сложном рассуждении, как это видно в тестах ARC Challenge и Winogrande. Я рекомендую использовать шаблон приглашения Llama3: https://llama.meta.com/docs/model-cards-and-prompt-formats/meta-llama-3/ Это объединение предварительно обученных языковых моделей, созданных с помощью mergekit. Эта модель была объединена с использованием метода слияния DARE TIES с использованием в качестве основы мета-ламы/Мета-Лламы-3-8B-Instruct. В объединение были включены следующие модели: NousResearch/Hermes-2-Pro-Llama-3-8B aaditya/Llama3-OpenBioLLM-8B Для создания этой модели использовалась следующая конфигурация YAML:

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: lighteternal
Теги: llama, mergekit, merge, conversational, text-generation-inference, endpoints_compatible
Лайков: 5  |  Загрузок: 32

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.