СФТ Ламы-3.1 8Б. Я собирался использовать DPO, но это ухудшило модель. Увеличение рейтинга рейтинга примерно на 50 пунктов в таблице лидеров Chaiverse по сравнению с предварительными версиями. Доработана Лама-3.1-8B на Locutusque/ApolloRP-2.0-SFT. В результате получается хорошая языковая модель ролевой игры, которая не является глупой. — Разработано: Locutusque — Тип модели: Llama3.1 — Язык(и) (NLP): Английский — Лицензия: Лицензионное соглашение сообщества Llama 3.1 — Демо: https://huggingface.co/spaces/Locutusque/Locutusque-Models Пользователи (как прямые, так и последующие) должны быть проинформированы о рисках, предвзятости и ограничениях модели. Для дальнейших рекомендаций необходимо больше информации.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Locutusque
Теги: llama, not-for-all-audiences, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 5 | Загрузок: 3
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.