Tulu — это серия языковых моделей, которые обучены действовать как полезные помощники. Tulu V2 DPO 13B — это доработанная версия Llama 2, которая была обучена на сочетании общедоступных, синтетических и человеческих наборов данных с использованием оптимизации прямых предпочтений (DPO). Эта модель является сильной альтернативой Llama 2 13b Chat. Более подробную информацию можно найти в статье «Верблюды в меняющемся климате: улучшение адаптации LM с помощью Тулу 2». — Тип модели: модель, принадлежащая набору инструкций и настроенным RLHF моделям чата на основе общедоступных, синтетических и созданных человеком наборов данных. — Язык(и) (NLP): Преимущественно английский. — Лицензия: AI2 ImpACT Лицензия с низким уровнем риска. — Точная настройка на основе модели: Meta-llama/Llama-2-13b-hf — Репозиторий: https://github.com/allenai/https://github.com/allenai/open-instruct — Рецепт DPO: рецепт DPO взят из бета-модели Zephyr — Семейство моделей: другие модели и набор данных можно найти в коллекции Tulu V2. Модель обучена использовать следующий формат (обратите внимание на новые строки): Для достижения наилучших результатов форматируйте все входные данные таким образом. Обязательно добавьте новую строку после , это может сильно повлиять на качество генерации. Модель изначально была доработана на основе отфильтрованных и предварительно обработанных…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: allenai
Теги: llama, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 21 | Загрузок: 1,414
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.