Это слияние предварительно обученных языковых моделей, созданных с помощью mergekit. Я попытался объединить два лучших итальянских LLM с помощью Mergekit. Результаты приемлемы, но я не смог улучшить лучшую существующую модель. Для подробного сравнения производительности моделей ознакомьтесь с таблицей лидеров для моделей на итальянском языке. Эта модель была объединена с использованием метода слияния СВЯЗЕЙ с использованием meta-llama/Meta-Llama-3-8B в качестве основы. Следующие модели были включены в слияние: swap-uniba/LLaMAntino-3-ANITA-8B-Inst-DPO-ITA DeepMount00/Llama-3-8b-Ita Для производства этой модели использовалась следующая конфигурация YAML:
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: anakin87
Теги: llama, mergekit, merge, conversational, it, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 933
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.