Он был создан путем слияния дельт, представленных в приведенном выше репозитории, с исходной моделью Llama 13B с использованием кода, представленного на их странице Github. Модели 13B: неквантованная модель 13B 1.1 для графического процессора — формат HF, квантованный GPTQ, 4 бита. 13B 1.1 для графического процессора — защитные датчики и форматы pt. квантованный GPTQ, 4 бита. 7B 1.1 для графического процессора — защитные датчики и форматы pt. Квантованный GPTQ 4 бита. 7B 1.1 для ЦП — формат GGML для llama.cpp. Тип модели: Vicuna — чат-бот с открытым исходным кодом, обученный путем тонкой настройки LLaMA на общих разговорах пользователей, собранных из ShareGPT. Это авторегрессивная языковая модель, основанная на архитектуре преобразователя. Дата модели: обучение Vicuna проходило в период с марта 2023 года по апрель 2023 года. Организации, разрабатывающие модель: команда Vicuna, состоящая из членов Калифорнийского университета в Беркли, CMU, Стэнфорда и Калифорнийского университета в Сан-Диего. Бумага или ресурсы для получения дополнительной информации: https://vicuna.lmsys.org/ Куда отправлять вопросы или комментарии по модели: https://github.com/lm-sys/FastChat/issues Основное предполагаемое использование: Основное использование Vicuna — исследования крупных языковых моделей и чат-ботов. Основные предполагаемые пользователи:…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: winglian
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 5
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.