Доработанный Llama-3 8B с нецензурированным/нефильтрованным набором данных разговоров Волшебника и Викуньи. Для тонкой настройки использовал QLoRA. Представленная здесь модель включает в себя версию HuggingFace fp32, а также квантованную 4-битную версию q4_0 gguf. Сначала установите Ollama. Следуя инструкциям здесь, выполните следующее: Создайте файл llama3-uncensored.modelfile со следующим:
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: georgesung
Теги: tensorboard, gguf, llama, text-generation-inference, endpoints_compatible
Лайков: 21 | Загрузок: 1,080
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.