Основана на Meta-Llama-3-8b-Instruct и регулируется лицензионным соглашением Meta Llama 3: https://huggingface.co/meta-llama/Meta-Llama-3-8B-Instruct Эта версия v0.3.2 еще больше не подвергается цензуре благодаря использованию https://huggingface.co/AwanLLM/Awanllm-Llama-3-8B-Dolfin-v0.6-Abliterated в качестве базовой модели. 0.0.2 предназначен для небольшой настройки этапа DPO. С точки зрения рассуждений и интеллекта, эта модель, вероятно, немного хуже, чем модель OG из-за децензирования. Однако эта модель лучше при длинных чатах взад и вперед и будет меньше отказываться. Эта модель лучше всего работает с системными подсказками, которые говорят ей, что это персонаж, а не говорят ей действовать как персонаж. Обучение: — Полная длина последовательности 8192. — Продолжительность обучения составляет около 2 дней на RTX 4090 с использованием 4-разрядной загрузки и Qlora 64-ранга 64-альфа, что дает ~2% тренируемых весов. FP16: https://huggingface.co/OwenArli/ArliAI-Llama-3-8B-Cumulus-v0.3.2 GGUF: https://huggingface.co/OwenArli/ArliAI-Llama-3-8B-Cumulus-v0.3.2-GGUF
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: OwenArli
Теги: llama, conversational, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 15
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.