Эта модель представляет собой предварительно обученную версию мультимодального проектора llava для mistralai/Mistral-7B-v0.1 в наборе данных liuhaotian/LLaVA-Pretrain. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 0,002 — trainbatchsize: 64 — evalbatchsize: 64 — начальное число: 42 — распределенный тип: multi-GPU — numdevices: 2 — градиентаккумуляция шагов: 2 — общий размер поезда: 256 — общий размер evalbatchsize: 128 — оптимизатор: Адам с betas=(0,9,0,999) и epsilon=1e-08 — lrschedulertype: cosine — lrschedulerwarmupsteps: 10 — num_epochs: 1 — Трансформаторы 4.34.1 — Pytorch 2.0.1+cu118 — Наборы данных 2.14.6 — Токенизаторы 0.14.1
Модальности:
Генерация текста
Задача: Генерация текста
Автор: openaccess-ai-collective
Теги: llava_mistral, generated_from_trainer, endpoints_compatible
Лайков: 49 | Загрузок: 15
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.