Jarvis1111/DoctorAgent-RL-SFT-1k-Thinking - Каталог нейросетей
Генерация текста

Jarvis1111/DoctorAgent-RL-SFT-1k-Thinking

Добавлено:
Jarvis1111/DoctorAgent-RL-SFT-1k-Thinking

DoctorAgent-RL — это новая многоагентная платформа для совместной работы на основе обучения с подкреплением (RL), которая моделирует медицинские консультации как динамический процесс принятия решений в условиях неопределенности. Он решает основные проблемы, с которыми сталкиваются студенты магистратуры в реальных клинических консультациях, такие как расплывчатые диагнозы из однораундовых систем и негибкость традиционных моделей многоходового диалога, ограниченных статическим контролируемым обучением. В DoctorAgent-RL агент-врач постоянно оптимизирует свою стратегию допроса в рамках RL посредством многоэтапного взаимодействия с агентом-пациентом. Эта динамическая корректировка путей сбора информации регулируется комплексным вознаграждением от оценщика-консультанта. Этот механизм тонкой настройки RL позволяет LLM автономно разрабатывать стратегии взаимодействия, соответствующие логике клинических рассуждений, выходя за рамки поверхностной имитации шаблонов в существующих диалоговых данных. В работе также представлен MTMedDialog, первый английский набор данных для многооборотных медицинских консультаций, способный моделировать взаимодействие с пациентами. Эксперименты показывают, что DoctorAgent-RL превосходит существующие модели как по возможностям многооборотного рассуждения, так и по окончательной диагностической производительности.

Модальности:
Генерация текста

Области применения:
Диалог / чат Медицина


Задача: Генерация текста
Автор: Jarvis1111
Теги: qwen2, medical, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 5  |  Загрузок: 255

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.