Генерация текста
「oasst1-89k-ja」データセットを追加して対話システムに対応しました。1024トークンまで会話履歴を保存できます。前回のモデルで行った質疑応答の正答率は今回のモデルで下がりました。「日本で一番広い湖は?」が91%から89%、「世界で一番高い山は?」が84%から73%に下がりました。(対話は分けた方が良かったのか、それともoasst1の質が良くないとか) 「japanese-gpt-1b」モデルを「databricks-dolly-15k-ja」データセットで~~RLHF (人間のフィードバックからの強化学習)~~Инструкция по настройкеしました。 1,3 ББ, GPT-2, видеопамять 7 ГБ, ОЗУ 7 ГБが必要で、問題なく動作すると思われます。 rinna社の「japanese-gpt-1b」を、日本語データセット「databricks-dolly-15k-ja」、 「oasst1-89k-ja」、 「OjousamaTalkScriptDataset」、 「train_data/zundamon.json」を使用して学習させました。このコードは、質問に答えるAIアシスタントを実装しています。質問リストに対して、役割指示に従った応答を生成し、会話を表示します。...