— Обучение на дополнительных токенах — Обучение на улучшенной модели предметной области — Обучение на 1,5 млн дополнительных токенов — Дополнительное обучение на наборе данных DPO Llama 3 — это сильная базовая модель с глубоким пониманием мира и креативностью. Дополнительные инструкции по тонкой настройке заменяют понимание мира и творческий подход на инструкции, которые не требуются Ламе для соблюдения большинства форм ролевой игры. Эта модель обучалась только на неструктурированном тексте, никакой тонкой настройки, связанной с инструкциями, не проводилось. (tryspellbound.com в настоящее время не использует эту модель, он использует сонет Claude 3.) – Ролевая игра в многоходовых историях, где история представлена в одном сообщении – Динамическое переключение стилей письма для разных сценариев – Интерпретация знаков форматирования «цитата» и «действие» Предупреждение: базовая модель Llama 3 была обучена на данных, включающих контент для взрослых. Эта тонкая настройка не добавляет дополнительных ограждений и подходит не для всех сред. Основная цель — изучить, как представление LLM с историей и инструкциями по отдельности влияет на их производительность, демонстрируя: — Улучшение связности в долгих разговорах — Улучшение качества взаимодействия персонажей…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: hf-100
Теги: llama, conversational, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 0
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.