SEA-LION — это коллекция больших языковых моделей (LLM), которые были предварительно обучены и настроены для региона Юго-Восточной Азии (ЮВА). Llama-SEA-LION-v2-8B — это многоязычная модель, которая прошла постоянную предварительную подготовку примерно на 48 миллиардах токенов на 5 языках SEA: английском, индонезийском, тамильском, тайском и вьетнамском. SEA-LION означает «Языки Юго-Восточной Азии в одной сети». — Разработано: Products Pillar, AI Singapore — Финансируется: Сингапур NRF — Тип модели: Декодер — Поддерживаемые языки: английский, индонезийский, тайский, вьетнамский, тамильский — Лицензия: лицензия сообщества Llama3 Мы провели постоянное предварительное обучение английскому и языкам SEA на Meta-Llama-3-8B-Instruct, модели декодера, использующей архитектуру Llama 3, для создания Llama-SEA-LION-v2-8B. Для токенизации модель использует токенизатор по умолчанию, используемый в Llama 3 8B Instruct. Мы оценивали Llama-SEA-LION-v2-8B на общих языковых возможностях. Для оценки общих языковых возможностей языков SEA мы использовали тест оценки BHASA для решения различных задач. Эти задачи включают в себя ответы на вопросы (QA), анализ настроений (Sentiment), обнаружение токсичности (токсичность), перевод в обоих направлениях…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: aisingapore
Теги: llama, en, id, ta, th, vi, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 169
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.