PLaMo-13B-Instruct — это тонко настроенная модель инструкций, построенная на версии модели генерации текста PLaMo-13B длиной контекста 8192. PLaMo-13B-Instruct настроен с использованием нескольких общедоступных японских наборов данных. Эта модель выпущена по лицензии Apache 2.0. — Размер модели: 13B — Обученные токены: токены 1,5T (английский: токены 1,32T, японский: токены 0,18T) — Токенизатор: токенизатор частей предложений, обученный на подмножестве наборов данных для предварительного обучения. — Длина контекста: 8192 — Разработано: Preferred Networks, Inc — Тип модели: Только причинный декодер — Язык(и): японский и английский — Лицензия: Apache License 2.0 — databricks-dolly-15k (перевод на японский) — Anthropic HH-RLHF (перевод на японский, подмножество) — Набор данных OpenAssistant Conversations (перевод на японский, oasst1) — Подмножество Wikinews Izumi-lab llm-japanese-dataset PLaMo-13B-Instruct — это новая технология, использование которой сопряжено с риском. Тестирование, проведенное на сегодняшний день, проводилось на английском и японском языках и не охватило и не могло охватить все сценарии. По этим причинам, как и в случае со всеми LLM, потенциальные результаты PLaMo-13B-Instruct-NC невозможно предсказать заранее, и в некоторых случаях модель может давать неточные, предвзятые или другие…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: pfnet
Теги: plamo, conversational, custom_code, en, ja
Лайков: 14 | Загрузок: 29
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.