> Это модель HuatuoGPT-Vision, основанная на архитектуре Qwen2.5-VL. Он был обучен на наборе данных PubMedVision с использованием платформы Qwen2.5-VL. Подробную информацию см. в коде обучения HuatuoGPT-Vision Code. HuatuoGPT-Vision — это мультимодальный LLM для медицинских приложений, созданный с использованием набора данных PubMedVision. HuatuoGPT-Vision-7B обучается на базе Qwen2-7B с использованием архитектуры LLaVA-v1.5. Для использования см. инструкцию Qwen2.5-VL, поскольку она имеет ту же архитектуру модели и шаблон использования. Здесь мы покажем фрагмент кода, показывающий, как использовать модель чата с преобразователями и qwenvlutils:
Модальности:
Генерация текста
Задача: Генерация текста
Автор: FreedomIntelligence
Теги: en, zh
Лайков: 10 | Загрузок: 2,288
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.