third-intelligence/llm-jp-4-kappa-32b-a3b-v0.1 - Каталог нейросетей
Генерация текста

third-intelligence/llm-jp-4-kappa-32b-a3b-v0.1

Добавлено:
third-intelligence/llm-jp-4-kappa-32b-a3b-v0.1

llm-jp-4-kappa-32b-a3b-v0.1 は、Третий интеллект が研究開発の一環で試作した日本語・英語対応の Thinking型大規模言語モデルです。llm-jp/llm-jp-4-32b-a3b-думаю をベースに、 — Рассуждение(思考プロセスの生成)能力を強化するための SFT (контролируемая точная настройка) — 数学・コード領域における強化学習 (Обучение с подкреплением) の 2段階の追加学習を行い、ベースモデルが持つ日本語性能を維持しつつ、推論・数学・コーディング能力の向上を目指しました。ベースモデルと同様、Mixture-of-Experts (MoE) アーキテクチャ(総パラメータ約 32B / активированный 約3B)を採用しているため、同規模の плотныйモデルと比較して推論時の計算コストを抑えつつ、高い性能を発揮します。トラブルシュート: RuntimeError: Уже заимствовано > 環境によっては、анализатор рассуждений の初期化時に токенизаторの競合により上記エラーが発生することがあります。その場合は кулинарная книга 内 llmjp4reasoningparser.py`の以下 2 行を、tokenizer.encode を経由しない形に置き換えてください。 > > Python (OpenAI SDK)からも同様に呼び出せます。—reasoning-parser llmjp4 を有効にしているため、思考プロセスは Reasoningcontentフィールドに、最終回答は content` フィールドに分離されて返ります。 本モデルは研究目的で公開されているモデルです。出力の正確性・安全性・倫理性は保証されず、事実と異なる内容(ハルシネーション)や不適切な内容を生成する可能性があります。商用利用やミッションクリティカルな用途での使用は想定していません。本モデルの利用により生じたいかなる損害についても開発者は責任を負いません。ライセンスはベースモデル(ll m-jp/llm-jp-4-32b-a3b-думаю)の条件も併せて確認・遵守してください。本モデルは Apache License 2.0 のもとで公開されます。ベースモデル llm-jp/llm-jp-4-32b-a3b-thinkingのライセンス・利用規約も併せて遵守してください。 -ベースモデルを公開してくださっている LLM-jp プロジェクト — NVIDIA — 評価フレームワーク глотать-llm/swallow-evaluation-instruct…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: third-intelligence
Теги: qwen3_moe, conversational, en, ja, endpoints_compatible
Лайков: 7  |  Загрузок: 2,640

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.