Minerva — это первое семейство LLM, прошедших предварительное обучение с нуля итальянскому языку, разработанное Sapienza NLP в контексте проекта Future Artificial Intelligence Research (FAIR) в сотрудничестве с CINECA и при дополнительном вкладе Babelscape и проекта CREATIVE PRIN. Примечательно, что модели Minerva являются действительно открытыми (данные и модель) итальянско-английскими LLM, примерно половина данных для предварительного обучения включает текст на итальянском языке. Полную информацию о технологии можно найти по адресу https://nlp.uniroma1.it/minerva/blog/2024/11/26/tech-report. Это модель карты для преобразования GGUF Minerva-7B-instruct-v1.0, модели с 7 миллиардами параметров, обученной почти на 2,5 триллионах токенов (1,14 триллиона на итальянском языке, 1,14 триллиона на английском языке и 200 миллиардов в коде). Этот репозиторий содержит веса моделей в форматах float32 и float16, а также квантованные версии с 8-битной, 6-битной и 4-битной точностью. Важно! Эта модель совместима с файлом llama.cpp, обновленным как минимум для фиксации 6fe624783166e7355cec915de0094e63cd3558eb (5 ноября 2024 г.).
Модальности:
Генерация текста
Области применения:
Следование инструкциям Диалог / чат
Задача: Генерация текста
Автор: sapienzanlp
Теги: gguf, chat, minerva-7b, instruct, dpo, it, en, endpoints_compatible
Лайков: 5 | Загрузок: 244
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.