MasterControlAIML/DeepSeek-R1-Qwen-2.5-1.5b-Latest-Unstructured-To-Structured - Каталог нейросетей
Генерация текста

MasterControlAIML/DeepSeek-R1-Qwen-2.5-1.5b-Latest-Unstructured-To-Structured

Добавлено:
MasterControlAIML/DeepSeek-R1-Qwen-2.5-1.5b-Latest-Unstructured-To-Structured

Эта модель представляет собой доработанную версию Qwen/Qwen2.5-1.5B-Instruct. Он был обучен с использованием TRL. Желаемый ввод — абзацы неструктурированного текста и пустые правила схемы. Выход — заполнен. Создан JSON из неструктурированного текста по следующей ссылке на набор данных правил пустой схемы. Чтобы узнать больше — https://huggingface.co/datasets/MasterControlAIML/JSON-Unstructured-Structured. Эта модель была обучена с помощью GRPO, метода, представленного в DeepSeekMath: расширение границ математического рассуждения в моделях открытого языка. — TRL: 0.14.0 — Трансформеры: 4.48.1 — Pytorch: 2.5.1+cu121 — Наборы данных: 3.1.0 — Токенизаторы: 0.21.0

Модальности:
Генерация текста

Области применения:
Диалог / чат Логика и рассуждение


Задача: Генерация текста
Автор: MasterControlAIML
Теги: tensorboard, qwen2, generated_from_trainer, trl, grpo, deepseek, r1, conversational
Лайков: 5  |  Загрузок: 24

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.