Версия языковой модели Llama-3.3-70B с улучшенным зрением, способная понимать и описывать изображения, сохраняя при этом языковые возможности базовой модели. — Базовая модель: Llama-3.3-70B — Тип модели: Модель Vision-Language — Последнее обновление: декабрь 2024 г. — Архитектура модели: архитектура Llama с видеокодером SigLIP
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: kadirnar
Теги: llamavision, conversational, custom_code
Лайков: 9 | Загрузок: 128
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.