Эта модель представляет собой доработанную версию google/flan-t5-xxl, предназначенную для задач поиска изображений и текста, как представлено в документе VQAScore. – Разработано: Чжицю Линь и соавторы – Тип модели: Генеративная модель Vision-Language – Лицензия: Apache-2.0 – Точная настройка на основе модели: google/flan-t5-xxl – Репозиторий: https://github.com/linzhiqiu/CLIP-FlanT5 – Документ: https://arxiv.org/pdf/2404.01291 – Демо: https://huggingface.co/spaces/zhiqiulin/VQAScore
Модальности:
Генерация текста
Задача: Генерация текста
Автор: zhiqiulin
Теги: t5, en, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 6,070
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.