dominguesm/canarim-7b - Каталог нейросетей
Генерация текста

dominguesm/canarim-7b

Добавлено:
dominguesm/canarim-7b

Canarim-7B — это модель большого португальского языка, разработанная Maicon Domingues. Модель была предварительно обучена на 16 миллиардах токенов из португальского подмножества CommonCrawl 2023-23, начиная с весов LLaMA2-7B. Данные для предварительной подготовки относятся к середине 2023 года. — Язык: специализируется на понимании и создании текста на португальском языке, что делает его идеальным для приложений, ориентированных на португалоязычную аудиторию. — Архитектура: наследует надежную архитектуру LLaMA2-7B, обеспечивая эффективную работу и точные результаты. — Разнообразный набор данных: набор данных для предварительного обучения включает в себя широкий спектр тем и стилей письма, что повышает способность модели понимать различные контексты и нюансы португальского языка. Canarim-7B обучался исключительно с целью моделирования языка и не был настроен для выполнения инструкций. Следовательно, он больше подходит для задач с небольшим количеством шагов, а не для задач с нулевым шагом. Это означает, что модель имеет тенденцию работать лучше, если во время ее использования предоставляется несколько примеров желаемого результата. Вот некоторые практические применения: — Понимание естественного языка (NLU): эффективно в таких задачах, как анализ настроений, классификация тем и распознавание объектов в…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: dominguesm
Теги: llama, LLM, Portuguese, Llama 2, pt, model-index, text-generation-inference
Лайков: 17  |  Загрузок: 1,827

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.