Организация, разрабатывающая модель Alibaba DAMO Academy, Университет Цинхуа. Набор обучающих данных. Обучающие данные Wombat-7B публикуются в RRHF. Тип модели Wombat-7B — это языковая модель общего назначения, выполняющая инструкции, согласованная с ChatGPT (в качестве прокси-предпочтений человека), точно настроенная на основе моделей Alpaca. Для точной настройки Альпаки мы используем новый метод под названием RRHF (Ранговый ответ для согласования обратной связи с человеком). Куда отправлять вопросы или комментарии по модели Вопросы, комментарии и обсуждения вомбатов и RRHF можно отправлять через репозиторий проекта на GitHub, открыв задачу. или отправьте электронное письмо по адресу yuanzheng.yuanzhen@alibaba-inc.com, yuanhy20@mails.tsinghua.edu.cn или chuanqi.tcq@alibaba-inc.com. Основное предполагаемое использование. Основное использование Wombat-7B и Wombat-7B-GPT4 — это исследования по изучению обратной связи между людьми и прототип методов RRHF. Основные предполагаемые пользователи Основными предполагаемыми пользователями Wombat-7B и Wombat-7B-GPT4 являются исследователи в области обработки естественного языка, машинного обучения и искусственного интеллекта. Варианты использования, выходящие за рамки области применения. Wombat-7B и Wombat-7B-GPT4 не настроены с использованием прокси-человеческих отзывов об OpenAIchatGPT и GPT4 и не предназначены для использования в производстве…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: GanjinZero
Теги: llama, en, text-generation-inference, endpoints_compatible
Лайков: 23 | Загрузок: 7
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.