crestf411/L3.1-8B-sunfall-v0.6.1-dpo - Каталог нейросетей
Генерация текста

crestf411/L3.1-8B-sunfall-v0.6.1-dpo

Добавлено:
crestf411/L3.1-8B-sunfall-v0.6.1-dpo

Sunfall (31 июля 2024 г.) v0.6.1 поверх слияния make-it-funner-DPO на Meta’s Llama-3 8B Instruct. Экспериментальный. Пожалуйста, дайте обратную связь. Уходите, если вы требуете совершенства. Этот эксперимент демонстрирует потенциал, но еще рано говорить о том, является ли он жизнеспособным вариантом. Инвестируйте свое время соответственно. Новое по сравнению с версией 0.5: значительное расширение набора данных (более чем в два раза), в частности, включение большого количества незагруженного контента SFW, чтобы сделать модель в целом более интеллектуальной. Включает рандомизированное подмножество AI-MO/NuminaMath-CoT * Были расширены обучающие элементы закона алмаза. Модели, похоже, не помнили правил, поэтому их перефразировали по-разному. Слияния/тонкие настройки: существует LoRA этой модели. Рассмотрите возможность объединения этого вместо объединения этой модели. Чтобы использовать теги книги знаний (пример), убедитесь, что вы используете Статус: Синий (постоянный) и напишите, например, Эта модель была обучена на контексте, который имитирует пресет инструкции Llama3 в Silly Tavern, со следующими настройками: Карта также была обучена на контенте, который включает в себя карту рассказчика, которая использовалась, когда контент в основном не вращался вокруг двух персонажей. В будущих версиях эта идея будет расширена, так что простите за неясность…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: crestf411
Теги: llama, not-for-all-audiences, conversational, text-generation-inference, endpoints_compatible
Лайков: 8  |  Загрузок: 4

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.