Представляем LUNA-SOLARkrautLM-Instruct — версию мощного upstage/SOLAR-10.7B-Instruct-v1.0 для UNA-Sauerkraut! Выровнен с DPO и приручен UNA. 1. Обзор всех моделей LUNA-SOLARkrautLM-Instruct 2. Сведения о модели — Шаблон запроса — Набор обучающих данных — Тест на загрязнение данных 3. Оценка 5. Отказ от ответственности 6. Контакт 7. Сотрудничество 8. Благодарность LUNA-SOLARkrautLM-Instruct — Тип модели: LUNA-SOLARkrautLM-Instruct — это модель UNA fblgit/UNA-SOLAR-10.7B-Instruct-v1.0 и мощный набор SauerkrautLM-SOLAR-Instruct — Язык(и): английский, немецкий — Лицензия: cc-by-nc-4.0 — Контакт: Веб-сайт Дэвид Гольхинфар Juanako.AI — UNA LUNA-SOLARkrautLM-Instruct была обучена с использованием дополнения немецких данных и переведенных данных. Согласовано через DPO с нашим новым немецким набором данных SauerkrautLM-DPO на основе частей набора данных SFT SauerkrautLM в качестве выбранных ответов и Sauerkraut-7b-HerO в качестве отклоненных ответов. Добавлены дополнительные переведенные части HuggingFaceH4/ultrafeedbackbinarized (наш набор данных не содержит никаких подсказок TruthfulQA — проверьте результаты теста на загрязнение данных) и argilla/distilabel-math-preference-dpo.** Мы обнаружили, что только простой перевод обучения…
Модальности:
Генерация текста
Области применения:
Следование инструкциям Диалог / чат
Задача: Генерация текста
Автор: fblgit
Теги: llama, finetune, dpo, Instruct, augmentation, german, conversational, en
Лайков: 8 | Загрузок: 193
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.