Это языковая модель LLaMA-7B, обученная на 10 000 подсказках и ответах по психологии, генерируемых ChatGPT. Модель была обучена на одном графическом процессоре A100 от Google Colab. Модель демонстрирует некоторые знания в области психологии и в целом работает лучше, чем ее родительская базовая модель. Эта модель была разработана в рамках дипломного проекта в области машинного обучения и психологии. Она использовалась в качестве базовой модели для дальнейшей тонкой настройки с использованием обучения с подкреплением. Целью диссертации было сравнить обучение с подкреплением на основе обратной связи человека и обратной связи ИИ. Когда статья будет доступна, она будет размещена здесь! Авторы: Сэмюэль Хёглунд, samhog@kth.se; Йозеф Хедри, jkhedri@kth.se
Модальности:
Генерация текста
Задача: Генерация текста
Автор: samhog
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 5
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.