Aquila — это большая языковая модель, независимо разработанная BAAI. Опираясь на модель Aquila, мы продолжили предварительное обучение, SFT (контролируемую точную настройку) и RL (обучение с подкреплением) в рамках многоэтапного процесса обучения, в результате чего была создана модель AquilaMed-RL. Эта модель обладает профессиональными возможностями в области медицины и демонстрирует значительную вероятность выигрыша при сравнении с аннотированными данными с использованием модели GPT-4. Модель AquilaMed-RL может выполнять медицинскую сортировку, запросы о лекарствах и общие вопросы и ответы. Мы откроем исходный код данных SFT и RL, необходимых для обучения модели. Кроме того, мы выпустим технический отчет с подробным описанием наших методов разработки модели для медицинской сферы, тем самым способствуя развитию сообщества открытого исходного кода. Кроме того, мы используем токенизатор и шаблон Qwen для обучения отраслевой модели. мы опубликовали наши контролируемые данные, вы можете найти их в Huggingface — SFT: https://huggingface.co/datasets/BAAI/AquilaMed-Instruct — RL: https://huggingface.co/datasets/BAAI/AquilaMed-RL субъективное: Используя GPT-4 для оценки, показатели выигрыша нашей модели по сравнению с эталонными ответами в аннотированном наборе проверочных данных…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: BAAI
Теги: aquila3, conversational, custom_code, endpoints_compatible
Лайков: 13 | Загрузок: 43
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.