jondurbin/airoboros-33b-gpt4 - Каталог нейросетей
Генерация текста

jondurbin/airoboros-33b-gpt4

Добавлено:
jondurbin/airoboros-33b-gpt4

Это точно настроенная модель LlaMa с 33b параметрами qlora, использующая полностью синтетические данные обучения, созданные gpt4 через https://github.com/jondurbin/airoboros. Набор данных, используемый для точной настройки этой модели, доступен здесь, с особым упором на: — мелочи — математику/рассуждение (хотя это все еще отстой) — кодирование — множественный выбор и заполнение пустых полей — контекстно-зависимые ответы на вопросы — теорию разума — misc/general Эта модель была доработана с помощью ответвления FastChat и поэтому использует стандартный шаблон викуньи: другими словами, это преамбула/системное приглашение, за которым следует один пробел, затем «ПОЛЬЗОВАТЕЛЬ:» (один пробел после двоеточия), затем приглашение (которое может состоять из нескольких строк, пробелов и т. д.), затем один пробел, за которым следует «АССИСТЕНТ:» (с одним пробелом после двоеточия). Для меня самым важным моментом является контекстно-зависимая поддержка ответов на вопросы без тщательного оперативного проектирования. Самый простой способ начать — использовать мою версию FastChat, которая по сути такая же, но допускает увеличенную длину контекста и добавляет поддержку многострочного ввода: Затем вы можете вызвать ее следующим образом (после загрузки модели): Под «послушным» я подразумеваю, что модель была обучена игнорировать то, что она…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: jondurbin
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 7  |  Загрузок: 497

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.