Метка: japanese - Страница 5 - Каталог нейросетей

Метка: japanese

Генерация текста

stockmark/gpt-neox-japanese-1.4b

Этот репозиторий предоставляет модель на основе GPT-NeoX с 1,4 млрд параметров, предварительно обученную на японском корпусе, состоящем примерно...

Генерация текста

cyberagent/calm2-7b

CyberAgentLM2 — это языковая модель, предназначенная только для декодера, предварительно обученная на токенах 1.3T общедоступных наборов данных на...

Генерация текста

naclbit/gpt-j-japanese-6.8b

Эта предварительно обученная модель находится в стадии разработки! Загрузка веса модели будет доступна в будущем. Предварительно обученная модель...

Генерация текста

bluepen5805/DeepSeek-R1-Distill-Qwen-14B-Japanese-gguf

こっちのがいいかも👉 mmnga/cyberagent-DeepSeek-R1-Distill-Qwen-14B-Japanese-gguf Модальности:Генерация текста Области применения:Диалог / чат Логика и рассуждение Задача: Генерация текста Автор: bluepen5805 Теги: gguf,...

Генерация текста

inu-ai/dolly-japanese-gpt-1b

「oasst1-89k-ja」データセットを追加して対話システムに対応しました。1024トークンまで会話履歴を保存できます。前回のモデルで行った質疑応答の正答率は今回のモデルで下がりました。「日本で一番広い湖は?」が91%から89%、「世界で一番高い山は?」が84%から73%に下がりました。(対話は分けた方が良かったのか、それともoasst1の質が良くないとか) 「japanese-gpt-1b」モデルを「databricks-dolly-15k-ja」データセットで~~RLHF (人間のフィードバックからの強化学習)~~Инструкция по настройкеしました。 1,3 ББ, GPT-2, видеопамять 7 ГБ, ОЗУ 7 ГБが必要で、問題なく動作すると思われます。 rinna社の「japanese-gpt-1b」を、日本語データセット「databricks-dolly-15k-ja」、 「oasst1-89k-ja」、 「OjousamaTalkScriptDataset」、 「train_data/zundamon.json」を使用して学習させました。このコードは、質問に答えるAIアシスタントを実装しています。質問リストに対して、役割指示に従った応答を生成し、会話を表示します。...

Генерация текста

stockmark/stockmark-13b

Stockmark-13b — это LLM с 13 миллиардами параметров, предварительно обученный с нуля на основе японского корпуса, состоящего примерно...

Генерация текста

weblab-GENIAC/Tanuki-8x8B-dpo-v1.0

Тануки-8x8Bは、フルスクラッチで約1.7Tトークン事前学習を行った8x8Bパラメータ(総パラメータ約47B、アクティブパラメータ約13B)の大規模言語モデルです。 Tanuki-8x8B-dpo-v1.0は、SFTおよびDPOにより対話用に調整されています。より詳細な情報についてはブログ記事を参照してください。 GENIAC 松尾研LLM開発プロジェクトのもと、一般公募により集まった有志の参加者(企業所属、学生、研究者等)が開発を実施しました。 AWQ 4 бита, GPTQ 4 бита, GPTQ 8 битов, GGUF цвета GGUF版は性能低下が発生している可能性があり、非推奨こちらの記事にTanuki-8x8Bおよびその量子化モデルの各種推論方法についてまとめていますので、ご確認ください。以下に一部の推論方法を解説します。また、vLLMを使って推論をする場合は独自アーキテクチャへの対応が必要となります。こちらから改変済みvLLMを以下のようにビルドしてご利用ください。なお、本モデルはデフォルトのシステムプロンプトである「以下は、タスクを説明する指示です。要求を適切に満たす応答を書きなさい。」以外を学習していないため、このシステムプロンプトの使用を推奨します。タスクの詳細はユーザープロンプトに記述してください。人手評価 Чат-бот Аренаを模したシステムを作成し、人手によるブラインドテストを実施しました。...

Генерация текста

weblab-GENIAC/Tanuki-8B-dpo-v1.0

Тануки-8Бは、フルスクラッチで約1.3Tトークン事前学習を行った約8Bパラメータの大規模言語モデルです。 Tanuki-8x8B-dpo-v1.0は、SFTおよびDPOにより対話用に調整されています。より詳細な情報についてはブログ記事を参照してください。 GENIAC 松尾研LLM開発プロジェクトのもと、一般公募により集まった有志の参加者(企業所属、学生、研究者等)が開発を実施しました。 AWQ 4 бита, GPTQ 4 бита, GPTQ 8 битов, GGUF цвета GGUF版は性能低下が発生している可能性があり、非推奨なお、本モデルはデフォルトのシステムプロンプトである「以下は、タスクを説明する指示です。要求を適切に満たす応答を書きなさい。」以外を学習していないため、このシステムプロンプトの使用を推奨します。タスクの詳細はユーザープロンプトに記述してください。人手評価 Чат-бот Arenaを模したシステムを作成し、人手によるブラインドテストを実施しました。(詳細はこちら)全評価データ(約2000件)を公開しています。...

Генерация текста

cyberagent/Mistral-Nemo-Japanese-Instruct-2408

Это японская модель с постоянным предварительным обучением, основанная на Mistralai/Mistral-Nemo-Instruct-2407. Обязательно обновите установку трансформаторов с помощью pip install...

Генерация текста

abeja/gpt-neox-japanese-2.7b

Открытый PR объединен 14 сентября 2022 г. Вы можете использовать эту модель с преобразователями v4.23 и более поздних...