trentmkelly/Llama-3.1-8b-Instruct-Pangram - Каталог нейросетей
Генерация текста

trentmkelly/Llama-3.1-8b-Instruct-Pangram

Добавлено:
trentmkelly/Llama-3.1-8b-Instruct-Pangram

Эта модель была точно настроена с помощью GRPO с использованием API Pangram в качестве функции вознаграждения. Прочтите сообщение в блоге об этой модели, чтобы понять больше. Эта модель чрезвычайно эффективна для обхода классификатора Pangram. Из 4767 протестированных эссе 3143 полностью ускользнули от обнаружения, и только 483 превысили порог в 50%. Эта модель непредсказуемо работает с другими инструментами обнаружения ИИ. Во время обучения использовалась системная подсказка: «Напишите эссе для пользователя». Варианты этого приглашения не были тщательно протестированы и, вероятно, повлияют на производительность модели по сравнению с классификатором. Доступ к этой модели закрыт, поскольку я считаю, что Pangram предоставляет очень качественный сервис, и не хочу без причины наносить ущерб их бизнесу. Если вам нужен доступ и у вас есть история учетной записи на HuggingFace, указывающая, что вы являетесь исследователем ИИ (даже просто любителем), я одобряю доступ, но в противном случае я бы предпочел ограничить распространение этой модели. Если вам будет предоставлен доступ к этой модели, вы соглашаетесь не распространять ее, включая квантование, дальнейшую тонкую настройку и т. д.

Модальности:
Генерация текста

Области применения:
Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: trentmkelly
Теги: peft, grpo, lora, trl, conversational
Лайков: 5  |  Загрузок: 0

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.