Модели Deepseek R1 — это превосходные, современные модели рассуждения, которые были обучены работать на двух языках: английском и китайском. Однако эти модели несовместимы с языком, который они создают: часто при запросе на японском языке выводится китайский или английский язык. По этой причине мы разработали светло-синий/DeepSeek-R1-Distill-Qwen-7B-Japanese как японскую версию R1. Эта модель представляет собой доработанную японскую версию deepseek-ai/DeepSeek-R1-Distill-Qwen-7B на нашем наборе данных blue/distilabel-reasoning-R1-Llama-70B, которая надежно и точно выводит японский язык в ответ на подсказки. При использовании этих моделей мы рекомендуем использовать температуру отбора проб в пределах 0,5–0,7, как в оригинальных моделях с дистиллированной жидкостью R1. Кроме того, мы заметили, что модель иногда имеет тенденцию повторяться чаще, чем исходная модель R1, поэтому мы также рекомендуем установить повторение пенальти` равным 1,1 или выше, если модель повторяется при обработке ваших подсказок. Мы оценили эту модель на точность вывода и процент действительных японских разделов, используя первые 50 строк набора данных SakanaAI/gsm8k-ja-test_250-1319. Мы сравниваем это с оригинальной моделью R1 и тестируем в обоих режимах…
Модальности:
Генерация текста
Области применения:
Диалог / чат Логика и рассуждение
Задача: Генерация текста
Автор: lightblue
Теги: qwen2, llama-factory, full, generated_from_trainer, conversational, ja, text-generation-inference, endpoints_compatible
Лайков: 33 | Загрузок: 18
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.