rinna/nekomata-7b-instruction - Каталог нейросетей
Генерация текста

rinna/nekomata-7b-instruction

Добавлено:
rinna/nekomata-7b-instruction

Модель представляет собой настроенную по инструкции версию rinna/nekomata-7b. Он принимает формат ввода Alpaca. 32-слойная языковая модель на основе преобразователя со скрытым размером 4096 пикселей. Подробности архитектуры см. в документе Qwen. Данные тонкой настройки представляют собой подмножество следующих наборов данных. Databricks Данные Dolly Японские Databricks Данные Dolly FLAN Инструкция Данные настройки и их японский перевод Izumi lab LLM Японский набор данных Следующие разделы используются alt aozora-txt CourseraParallel ParaNatCom Tab-delimitedBilingualSentencePairs tanaka-corpus wikinews wordnet yasashi-japanese Остальные разделы содержат часто используемые корпуса оценок, поэтому они пропускаются во избежание утечки данных. ~~~~python импортирует факел из трансформаторов import AutoTokenizer, AutoModelForCausalLM tokenizer = AutoTokenizer.frompretrained(«rinna/nekomata-7b-instruction»,trustremote_code=True) model = AutoModelForCausalLM.frompretrained(«rinna/nekomata-7b-instruction», devicemap=»auto»,trustremotecode=True) инструкция = «次の日本語を英語に翻訳してください。» input = «大規模言語モデル(だいきぼげんごモデル、英: большой язык модель、LLM)は、多数のパラメータ(数千万から数十億)を持つ人工ニューラルネットワークで構成されるコンピュータ言語モデルで、膨大なラベルなしテキストを使用して自己教師あり学習または半教師あり学習によって訓練が行われる。»…

Модальности:
Генерация текста

Области применения:
Следование инструкциям


Задача: Генерация текста
Автор: rinna
Теги: qwen, custom_code, ja, en
Лайков: 10  |  Загрузок: 899

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.