Canarim-7B — это модель большого португальского языка, разработанная Maicon Domingues. Модель была предварительно обучена на 16 миллиардах токенов из португальского подмножества CommonCrawl 2023-23, начиная с весов LLaMA2-7B. Данные для предварительной подготовки относятся к середине 2023 года. — Язык: специализируется на понимании и создании текста на португальском языке, что делает его идеальным для приложений, ориентированных на португалоязычную аудиторию. — Архитектура: наследует надежную архитектуру LLaMA2-7B, обеспечивая эффективную работу и точные результаты. — Разнообразный набор данных: набор данных для предварительного обучения включает в себя широкий спектр тем и стилей письма, что повышает способность модели понимать различные контексты и нюансы португальского языка. Canarim-7B обучался исключительно с целью моделирования языка и не был настроен для выполнения инструкций. Следовательно, он больше подходит для задач с небольшим количеством шагов, а не для задач с нулевым шагом. Это означает, что модель имеет тенденцию работать лучше, если во время ее использования предоставляется несколько примеров желаемого результата. Вот некоторые практические применения: — Понимание естественного языка (NLU): эффективно в таких задачах, как анализ настроений, классификация тем и распознавание объектов в…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: dominguesm
Теги: llama, LLM, Portuguese, Llama 2, pt, model-index, text-generation-inference
Лайков: 17 | Загрузок: 1,827
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.