Cendol — это коллекция с открытым исходным кодом точно настроенных генеративных больших языковых моделей на индонезийских языках, охватывающих архитектуры моделей преобразователей только декодера и кодировщика-декодера в масштабе от 300 миллионов до 13 миллиардов параметров. Это репозиторий модели инструкций 7B Cendol LLaMA-2. Ссылки на другие модели можно найти ниже. IndoNLP разработала и публично выпустила семейство больших языковых моделей (LLM) Cendol — коллекцию предварительно обученных и точно настроенных генеративных текстовых моделей с масштабом от 560 миллионов до 13 миллиардов параметров. Модели Cendol охватывают две версии, настроенные на инструкции: 1. Cendol-Instruct, который настроен на инструкции для конкретных задач НЛП-данных, таких как анализ настроений, тематическое моделирование, машинный перевод, обобщение, ответы на вопросы, перефразирование и т. д. 2. Cendol-Chat, который постоянно настраивается инструкциями из Cendol-Instruct на общие знания и ориентированные на человека подсказки. И Cendol-Instruct, и Cendol-Chat предназначены для одноразового разговора. Cendol с огромным отрывом превосходит многоязычные и региональные LLM с открытым исходным кодом по большинству тестов, которые мы тестировали, с меньшей версией (Cendol состоит из двух базовых моделей (mT5 и…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: indonlp
Теги: llama, id, su, jv, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 23
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.