Метка: japanese - Страница 3 - Каталог нейросетей

Метка: japanese

Генерация текста

cyberagent/CAT-Thinking-8B

CAT-мышление обучено генерировать рассуждения на японском языке посредством обучения с подкреплением. Модель основана на Qwen3-Swallow-v0.2, которая представляет собой...

Генерация текста

DataPilot/ArrowCanaria-Llama-8B-RL-v0.1

ArrowCanaria-Llama-8B-RL-v0.1 は、ArrowCanaria-Llama-8B-SFT-v0.1 に対して RLHF(Обучение с подкреплением у человека Обратная связь) SFTモデルは高品質なデータで学習されていますが、モデルの応答が「データに含まれる平Награда Модель)品質や知識応答の正確性・分かりやすさを、SFTの水準からさらに引き上げています。強化学習アルゴリズムには GRPO (Оптимизация относительной политики группы)を採用し、DAPO損失関数による安定した最適化を実現しています。相談応答と知識応答の2フェーズで段階的にRLHFを行うことで、SFTで獲得した雑談・RP・キャラクター対話能力を保持しつつ、応答の質を選択的に向上させています。 —...

Генерация текста

inu-ai/alpaca-guanaco-japanese-gpt-1b

1,3 ГБ, GPT, 7 ГБ видеопамяти, 7 ГБ оперативной памяти.が必要で、問題なく動作すると思われます。 rinna社の「japanese-gpt-1b」を、日本語データセット「alpaca_ja 」および「GuanacoDataset」から抽出された日本語データを使用して学習させました。このコードは、与えられた役割指示と会話履歴に基づいて、新しい質問に対して応答を生成する機能を持っています。以下に、コードの各部分を簡単に説明します。 1. подготовить ввод関数は、役割指示、会話履歴、および新しい会話(質問)を受け取り、入力テキストを準備します。 2. формат вывода関数は、生成された応答を整形して、不要な部分を削除し、適切な形式に変換します。...

Генерация текста

nri-ai/gpt-oss-20b-Ja-Fin-Thinking

Японская модель рассуждений в финансовой сфере, созданная посредством контролируемой тонкой настройки gpt-oss-20b-Ja-Fin-CPT. Обучены давать высококачественные ответы с четкими...

Генерация текста

Elizezen/SniffyOtter-7B

В этом репозитории размещена SniffyOtter-7B, усовершенствованная модель японского языка, специально предназначенная для создания эротических романов. SniffyOtter создан для...

Генерация текста

yellowback/gpt-neo-japanese-1.3B

Модель генерации текста Модальности:Генерация текста Задача: Генерация текста Автор: yellowback Теги: gpt_neo, text generation, causal-lm, japanese, ja, endpoints_compatibleЛайков:...

Генерация текста

stockmark/stockmark-13b-instruct

Stockmark-13b-instruct — это настроенная на инструкции версия Stockmark-13b, японского LLM с 13 миллиардами параметров. Эта модель разработана Stockmark...

Генерация текста

kyo-takano/open-calm-7b-8bit

8-битная квантовая версия OpenCALM-7B от CyberAgent (под CC BY-SA 4.0). При использовании этой квантовой модели обязательно указывайте оригинал....

Генерация текста

cyberagent/open-calm-large

OpenCALM — это набор языковых моделей, предназначенных только для декодирования, предварительно обученных на японских наборах данных, разработанных CyberAgent,...