обновление 25 июня 2023 г. — повторно загружено с немного более ранней контрольной точкой, которая, возможно, немного менее подходит, чем изначально загруженная полная версия с 3 эпохами. Это полная (не qlora) модель LlaMa с точной настройкой 13b параметров, использующая полностью синтетические данные обучения, созданные gpt4 через https://github.com/jondurbin/airoboros. В основном это расширение предыдущей серии gpt-4 с некоторыми дополнениями: исправлены (+ больше примеров) примеры кодирования многосимвольных многоходовых диалогов на 10 языках из набора данных Rosettacode.org благодаря Майку, также известному как kryptkpr: https://huggingface.co/datasets/mike-ravkine/rosettacode-parsed больше примеров ролевых игр шутки загадки все инструкции по кодированию теперь имеют эквивалентную версию «PLAINFORMAT» (и все примеры Rosettacode были обучены с помощью PLAINFORMAT) Итак другими словами, это преамбула/системное приглашение, за которым следует один пробел, затем «ПОЛЬЗОВАТЕЛЬ:» (один пробел после двоеточия), затем приглашение (которое может состоять из нескольких строк, пробелов и т. д.), затем один пробел, за которым следует «ПОМОЩНИК:» (с одним пробелом после двоеточия). Чтобы запустить полноценную версию/родную версию Pytorch, вы можете использовать мою вилку FastChat, которая практически такая же, но позволяет…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: jondurbin
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 18 | Загрузок: 1,183
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.