LLaMAntino-2-13b — это модель большого языка (LLM), которая представляет собой адаптированную к итальянскому языку LLaMA 2. Цель этой модели — предоставить итальянским исследователям НЛП базовую модель для задач генерации естественного языка. The model was trained using QLora and using as training data cleanmc4it medium. Если вас интересует более подробная информация о процедуре обучения, вы можете найти использованный нами код по следующей ссылке: — Репозиторий: https://github.com/swapUniba/LLaMAntino ВНИМАНИЕ: код еще не опубликован, приносим извинения за задержку, он будет доступен как можно скорее! — Разработано: Пьерпаоло Базиле, Элио Мусаккио, Марко Полиньяно, Люсия Сицилиани, Джузеппе Фьямени, Джованни Семераро — Финансируется: проект PNRR FAIR — Будущие исследования искусственного интеллекта — Вычислительная инфраструктура: суперкомпьютер Leonardo — Тип модели: LLaMA 2 — Язык(и) (NLP): Итальянский — Лицензия: Llama 2 Community License — Точно настроено на основе модели: Meta-llama/Llama-2-13b-hf Если у вас возникли проблемы при загрузке модели, вы можете попробовать загрузить ее в квантованном виде: Если вы используете эту модель в своем исследовании, укажите следующее: Примечание: Llama 2 распространяется под лицензией сообщества LLAMA 2, Copyright © Meta Platforms, Inc. Все права защищены. Лицензия
Модальности:
Генерация текста
Задача: Генерация текста
Автор: swap-uniba
Теги: llama, text-generation-inference, it, endpoints_compatible
Лайков: 6 | Загрузок: 5
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.