TucanoBR/Tucano-630m - Каталог нейросетей
Генерация текста

TucanoBR/Tucano-630m

Добавлено:
TucanoBR/Tucano-630m

Tucano — это серия декодеров-трансформеров, предварительно обученных на португальском языке. Все модели Tucano были обучены на GigaVerbo — объединении дедуплицированных португальских текстовых корпусов объемом 200 миллиардов токенов. — Архитектура: модель на основе Transformer, предварительно обученная с помощью причинно-языкового моделирования. — Размер: 630 253 568 параметров. — Длина контекста: 2048 токенов. — Набор данных: TucanoBR/GigaVerbo. — Язык: португальский. — Количество шагов: 400 000. — Графический процессор: 8 NVIDIA A100-SXM4-80GB. — Время обучения: ~ 170 часов. — Выбросы: 350. KgCO2 (Германия) — Общее энергопотребление: 920 кВтч. В этом репозитории имеется исходный код, используемый для обучения этой модели. Основные используемые библиотеки: — PyTorch — Трансформеры — Наборы данных — Токенизаторы — Sentencepiece — Accelerate — FlashAttention — Liger Kernel — Codecarbon — TRL Основное назначение моделей Tucano — служить основой для исследований и разработок, включающих моделирование на родном португальском языке. Контрольные точки, сохраненные во время обучения, предназначены для обеспечения контролируемых настроек для проведения сравнительных экспериментов, в частности, в отношении влияния активного предварительного обучения на производительность доступных в настоящее время тестов. Вы также можете настроить и адаптировать…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: TucanoBR
Теги: jax, llama, text-generation-inference, pt, model-index, co2_eq_emissions, endpoints_compatible
Лайков: 4  |  Загрузок: 82

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.