Метка: japanese - Каталог нейросетей

Метка: japanese

Генерация текста

team-hatakeyama-phase2/Tanuki-8x8B-dpo-v1.0-GPTQ-4bit

GENIAC 松尾研 LLM開発プロジェクトで開発されたLLMであるweblab-GENIAC/Tanuki-8x8B-dpo-v1.0のGPTQ 4bit量子化モデルです。 キャリブレーションセットにはizumi-lab/wikipedia-ja-20230720からランダムサンプリングした1000件を利用しています。 この元モデルは独自アーキテクチャを持つモデルであるため、変換のためにAutoGPTQライブラリの一部改変が必要となりました。本モデルの変換に必要な改変を施したAutoGPTQをこちらで公開しています。 また、同様の理由で本モデルをvLLMを使って推論する際にはvLLMライブラリの一部改変が必要となります。本モデルの推論に必要な改変を施したvLLMをこちらで公開しています。 これを以下のようにソースからビルドし推論に利用してください。 Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор:...

Генерация текста

team-hatakeyama-phase2/Tanuki-8x8B-dpo-v1.0-AWQ

GENIAC 松尾研 LLM開発プロジェクトで開発されたLLMであるweblab-GENIAC/Tanuki-8x8B-dpo-v1.0のAWQ 4bit量子化モデルです。 キャリブレーションセットにはizumi-lab/wikipedia-ja-20230720からランダムサンプリングした512件を利用しています。 この元モデルは独自アーキテクチャを持つモデルであるため、変換のためにAutoAWQライブラリの一部改変が必要となりました。本モデルの変換に必要な改変を施したAutoAWQをこちらで公開しています。 また、同様の理由で本モデルをvLLMを使って推論する際にはvLLMライブラリの一部改変が必要となります。本モデルの推論に必要な改変を施したvLLMをこちらで公開しています。 これを以下のようにソースからビルドし推論に利用してください。 Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор:...

Генерация текста

Elizezen/LewdSniffyOtter-7B

Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: Elizezen Теги: mistral, not-for-all-audiences, japanese, text-generation-inference, endpoints_compatibleЛайков: 3  | ...

Генерация текста

skytnt/gpt2-japanese-lyric-small

Training data contains 143,587 Japanese lyrics which are collected from uta-net by lyric_download Модальности:Генерация текста Задача: Генерация текста...

Генерация текста

knok/japanese-distilgpt2

このモデルはrinna/japanese-gpt2-meduimを教師として蒸留したものです。 蒸留には、HuggigFace Transformersのコードをベースとし、りんなの訓練コードと組み合わせてデータ扱うよう改造したものを使っています。 学習に当たり、Google Startup Programにて提供されたクレジットを用いました。 a2-highgpu-4インスタンス(A100 x 4)を使って4か月程度、何度かのresumeを挟んで訓練させました。 Wikipediaをコーパスとし、perplexity 40 程度となります。 rinna/japanese-gpt2-meduim を直接使った場合、27 程度なので、そこまで及びません。 何度か複数のパラメータで訓練の再開を試みたものの、かえって損失が上昇してしまう状態となってしまったので、現状のものを公開しています。 This model...

Генерация текста

kawaimasa/Wanabi-Gemma4-31B

Wanabi-Gemma4-31B は、Google Gemma 4 31B-IT をベースに、専用デスクトップアプリ Project Wannabe の執筆ワークフローに最適化したファインチューニングモデルです。 本モデルの主な目的は、Project Wannabe が生成する専用のプロンプトフォーマットにモデルを適応させる ことです。Project Wannabe は、小説本文の生成(GEN)、続き生成(CONT)、アイデア生成(IDEA)といったタスクごとに、タイトル・あらすじ・プロット・本文・レーティングなどの情報を独自の構造化フォーマットで組み立てて送信します。本モデルは、この入力形式を正しく理解し、各タスクの意図に沿った応答を返せるよう学習しています。 加えて、日本語の思考過程(CoT)データを学習に組み込むことで、創作タスクにおける語彙選択や文体の自然さなど、日本語の創作表現の向上も目指しています。 従来の wanabi...

Генерация текста

kawaimasa/wanabi_mini_12b_GGUF

wanabimini12bGGUF** は、小説執筆支援に特化してファインチューニングされた日本語大規模言語モデルです。wanabi-24Bと同等の機能を有しながらより多くのユーザーが扱い易いモデルを用意しました。 このモデルは、mistralai/Mistral-Nemo-Base-2407 をベースとし、24B版よりもデータセットの規模は小さいものの、より高品質な日本語の小説関連テキストデータを用いて学習されています。アイデア出しから本文生成、文脈に沿った続きの生成、そしてアイデアの補間まで、小説執筆の様々なプロセスをサポートすることを目指しています。 提供形式: 現在、GGUF 形式のみ提供しています。VRAM 8GB以上のコンシューマGPUに適合する複数の量子化バージョンを用意。全て量子化モデルは特性のキャリブレーションデータを用いてimatrix量子化されています。 特徴: 24B版と比較して、より高品質なデータセットで学習されており、応答性や特定のタスクにおける精度向上が期待されます。 このモデルは、専用のデスクトップアプ アイデア補間機能 (新): 目的: Project Wannabe の「詳細情報」タブで、小説のアイデアに必要な全ての項目(タイトル、キーワード、ジャンル、あらすじ、設定、プロット)が入力されている場合に、それらの情報を基により詳細で深掘りされたアイデアや展開のヒントを生成します。 適用:...

Генерация текста

kawaimasa/wanabi_24b_preview_gguf

wanabi-24B は、小説執筆支援に特化してファインチューニングされた大規模言語モデルの プレビュー版 (preview) です。 このモデルは、mistralai/Mistral-Small-24B-Base-2501 をベースとし、日本語の小説関連テキストデータを用いて学習されました。特に、小説のアイデア出し、設定に基づいた本文生成、文脈に沿った続きの生成といったタスクを得意とします。 アルファ版に関する注意: 概念実証 (Proof of Concept): 本バージョンは機能検証を目的としています。 限定的な学習: 学習はデータセットの内 1500 ステップ(plusは2000step bs24)のみ行われています。...

Генерация текста

if001/tiny_mixtral_ja

Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: if001 Теги: mixtral, ja, japanese, en, text-generation-inferenceЛайков: 4  | ...