Minerva — первое семейство LLM, прошедших предварительное обучение итальянскому языку с нуля, разработанное Sapienza NLP в сотрудничестве с Future Artificial Intelligence Research (FAIR) и CINECA. Примечательно, что модели Minerva представляют собой действительно открытые (данные и модель) итальянско-английские LLM, примерно половина данных для предварительного обучения включает текст на итальянском языке. Это карточка модели Minerva-350M-base-v1.0, модели с 350 миллионами параметров, обученной на 70 миллиардах токенов (35 миллиардов на итальянском языке, 35 миллиардов на английском языке). Minerva-350M-base-v1.0 Minerva-1B-base-v1.0 Minerva-3B-base-v1.0 Minerva-7B-base-v1.0 * Minerva-7B-instruct-v1.0 В этом разделе указаны предсказуемые вредные последствия и недоразумения. Это базовая модель, не подлежащая выравниванию. Модель может: — преувеличивать одни точки зрения и недооценивать другие — содержать стереотипы — содержать личную информацию — генерировать: — ненавистнические, оскорбительные или агрессивные выражения — дискриминационные или предвзятые выражения — контент, который может не подходить для всех условий, включая контент сексуального характера — совершать ошибки, в том числе предоставлять неверную информацию, как если бы она была фактической — генерировать нерелевантные или повторяющиеся результаты Мы знаем о предвзятости, которая…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: sapienzanlp
Теги: mistral, pretrained, it, en, text-generation-inference, endpoints_compatible
Лайков: 16 | Загрузок: 3,033
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.