lokahq/Trinity-Mini-DrugProt-Think - Каталог нейросетей
Генерация текста

lokahq/Trinity-Mini-DrugProt-Think

Добавлено:
lokahq/Trinity-Mini-DrugProt-Think

Trinity-Mini-DrugProt-Think RLVR (GRPO) + LoRA после обучения на Arcee Trinity Mini для классификации отношений DrugProt. 📝 Отчет |  Руководство по развертыванию AWS |  GitHub Адаптер LoRA, настроенный на Arcee Trinity Mini с использованием GRPO (оптимизация групповой относительной политики) для извлечения связей между лекарством и белком в тесте DrugProt (BioCreative VII). Модель классифицирует 13 типов лекарственно-белковых взаимодействий из рефератов PubMed, создавая структурированные следы фармакологических рассуждений, прежде чем дать ответ. Обучение длилось около 100 шагов на инфраструктуре Prime Intellect. Награда за лучшую точность во время тренировки достигла ~0,83. — Это адаптер LoRA, для работы которого требуется базовая модель (arcee-ai/Trinity-Mini). — Оценивается на основе данных, разделенных на обучение; еще не проверен в официальном наборе тестов DrugProt — оптимизирован специально для 13-факторной классификации DrugProt; не может быть обобщено на другие биомедицинские задачи RE @misc{jakimovski2026drugprotrl, title = {Пост-обучение открытой модели MoE для извлечения связей лекарство-белок: Trinity-Mini-DrugProt-Think}, автор = {Jakimovski, Bojan and Kalinovski, Petar}, год = {2026}, месяц = ​​февраль, Howpublished =…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: lokahq
Теги: peft, lora, grpo, reinforcement-learning, biomedical, relation-extraction, drug-protein, moe
Лайков: 5  |  Загрузок: 6

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.