Тип модели: PLLaVA-34B — это чат-бот на видеоязыке с открытым исходным кодом, обученный путем тонкой настройки Image-LLM на данных, следующих за видеоинструкциями. Это авторегрессивная языковая модель, основанная на архитектуре преобразователя. Базовый LLM: liuhaotian/llava-v1.6-34b Бумага или ресурсы для получения дополнительной информации: — репозиторий GitHub: https://github.com/magic-research/PLLaVA — страница проекта: https://pllava.github.io/ — ссылка на документ: https://arxiv.org/abs/2404.16994 Куда отправлять вопросы или комментарии по модели: https://github.com/magic-research/PLLaVA/issues Основное предполагаемое использование: Основное использование PLLaVA — исследование крупных мультимодальных моделей и чат-ботов. Основные предполагаемые пользователи. Основными предполагаемыми пользователями модели являются исследователи и любители компьютерного зрения, обработки естественного языка, машинного обучения и искусственного интеллекта. Набор из 6 тестов, включая 5 тестов качества видео и 1 тест, специально предложенный для Video-LMM.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: ermu2001
Теги: llava, video LLM, conversational, endpoints_compatible
Лайков: 14 | Загрузок: 15
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.