SEA-LION — это коллекция больших языковых моделей (LLM), которые были предварительно обучены и настроены для региона Юго-Восточной Азии (ЮВА). Apertus-SEA-LION-v4-8B-IT — это модель с 8 миллиардами параметров, построенная на архитектуре Apertus-8B-Instruct. Чтобы обеспечить адаптацию предметной области для региона, модель прошла тщательное постобучение на тщательно подобранном наборе данных, состоящем примерно из 6,4 миллионов пар инструкций и текста. Это обширное пост-обучение прививает свободное владение многоязычным и мультикультурным языком, охватывая ключевые языки ЮВА, такие как индонезийский, вьетнамский, тайский, филиппинский, тамильский, бирманский, малайский. Этот тщательно подобранный набор данных также включает в себя отфильтрованный набор пар «инструкция-текст» с открытым исходным кодом, обеспечивающий эти возможности в дополнение к беглому владению языком. Apertus-SEA-LION-v4-8B-IT разработан как полностью открытая модель в соответствии с этой основной философией. Мы выпустили наборы данных, используемые для постобучения, а также оценочные коды и наборы данных, используемые для оценки модели. — Открытые наборы данных после обучения, которые мы использовали. — Оценочные коды и наборы данных SEA-HELM SEA-LION означает «Языки Юго-Восточной Азии в одной сети». Мы провели пост-обучение на английском и языках SEA на Apertus-8B-Instruct-2509,…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: aisingapore
Теги: apertus, conversational, en, zh, vi, id, th, fil
Лайков: 5 | Загрузок: 323
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.