Мы представляем AmberSafe, модель инструкций с точной настройкой безопасности, использующую в качестве основы LLM360/AmberChat. AmberSafe является частью модельной серии Pebble компании LLM360. — Тип модели: языковая модель с той же архитектурой, что и LLaMA-7B — Язык(и) (NLP): английский — Лицензия: Apache 2.0 — Ресурсы для получения дополнительной информации: — Метрики — Полностью обработанные данные предварительного обучения Amber — Код тонкой настройки Мы отфильтровали набор данных, выбрав все образцы данных с разными логическими значениями в isresponse0safe и isresponse1safe. Это позволит гарантировать, что для каждой пары в наборе данных предпочтений выбранный текст безопасен, а отклоненный — небезопасен. Мы следовали инструкциям в репозитории dpo, чтобы настроить эту модель. 1. Запустите контролируемую точную настройку (SFT) для интересующего набора данных. 2. Запустите обучение предпочтениям модели, начиная с шага 1, используя данные о предпочтениях (в идеале из того же распределения, что и примеры SFT). Чтобы использовать квантовую версию AmberSafe на своем персональном компьютере или ноутбуке, выполните следующие действия: 1. Сначала установите Ollama, следуя инструкциям, представленным здесь. Затем создайте квантованную версию модели AmberSafe (скажем, ambersafe.Q80.gguf для 8-битной квантованной версии), следуя инструкциям здесь…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: LLM360
Теги: llama, nlp, llm, en, text-generation-inference, endpoints_compatible
Лайков: 7 | Загрузок: 48
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.