Minerva — первое семейство LLM, прошедших предварительное обучение итальянскому языку с нуля, разработанное Sapienza NLP в сотрудничестве с Future Artificial Intelligence Research (FAIR) и CINECA. Примечательно, что модели Minerva являются действительно открытыми (данные и модель) итальянско-английскими LLM, примерно половина данных для предварительного обучения включает текст на итальянском языке. Это модель карты Minerva-7B-base-v1.0, модели с 7 миллиардами параметров, обученной почти на 2,5 триллионах токенов (1,14 триллиона на итальянском языке, 1,14 триллиона на английском языке и 200 миллиардов в коде). Minerva-350M-base-v1.0 Minerva-1B-base-v1.0 Minerva-3B-base-v1.0 Minerva-7B-base-v1.0 * Minerva-7B-instruct-v1.0 В этом разделе указаны предсказуемые вредные последствия и недоразумения. Это базовая модель, не подлежащая выравниванию. Модель может: — Преувеличивать одни точки зрения и недооценивать другие — Содержать стереотипы — Содержать личную информацию — Создавать: — Расистский и сексистский контент — Ненавистнические, оскорбительные или агрессивные выражения — Дискриминационные или предвзятые выражения — Контент, который может не подходить для всех условий, включая контент сексуального характера — Допускать ошибки, включая представление неверной информации или исторических фактов, как если бы они были…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: sapienzanlp
Теги: mistral, pretrained, it, en, text-generation-inference, endpoints_compatible
Лайков: 15 | Загрузок: 1,418
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.