Тип модели: LLaVA-Hound — это большая мультимодальная модель видео с открытым исходным кодом, точно настроенная из видеоинструкций, следующих за данными на основе большой языковой модели. Эта модель обучена с DPO из набора данных предпочтений видеоинструкций 17k из ShareGPTVideo/LLaVA-Hound-SFT ckpt. Бумага или ресурсы для получения дополнительной информации: https://github.com/RifleZhang/LLaVA-Hound-DPO Куда отправлять вопросы или комментарии о модели: https://github.com/RifleZhang/LLaVA-Hound-DPO/issues Основные предполагаемые пользователи: Исследователи в области искусственного интеллекта, большой мультимодальной модели и т. д. Следуйте https://github.com/RifleZhang/LLaVA-Hound-DPO/blob/main/README.md
Модальности:
Генерация текста
Задача: Генерация текста
Автор: ShareGPTVideo
Теги: llava_llama
Лайков: 3 | Загрузок: 29
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.