Метка: vision-language-model - Страница 2 - Каталог нейросетей

Метка: vision-language-model

Генерация текста

YanweiLi/llama-vid-7b-full-224-long-video

LLaMA-VID расширяет возможности существующих платформ для поддержки часовых видео и расширяет их верхний предел с помощью дополнительного токена...

Генерация текста

YanweiLi/MGM-2B

Платформа поддерживает серию плотных моделей и моделей большого языка (LLM) MoE от 2B до 34B с одновременным пониманием,...

Генерация текста

YanweiLi/MGM-34B-HD

Платформа поддерживает серию плотных моделей и моделей большого языка (LLM) MoE от 2B до 34B с одновременным пониманием,...

Генерация текста

YanweiLi/MGM-7B-HD

Платформа поддерживает серию плотных моделей и моделей большого языка (LLM) MoE от 2B до 34B с одновременным пониманием,...

Генерация текста

tencent/Penguin-VL-2B

Penguin-VL изучает пределы эффективности VLM с помощью кодировщиков машинного зрения на основе LLM. Страница проекта: penguin-vl.github.io | GitHub:...

Генерация текста

tencent/Penguin-VL-8B

Penguin-VL изучает пределы эффективности VLM с помощью кодировщиков машинного зрения на основе LLM. Страница проекта: penguin-vl.github.io | GitHub:...