Fine-tuned OpenLLaMA-7B with an uncensored/unfiltered Wizard-Vicuna conversation dataset digitalpipelines/wizardvicuna70k_uncensored. Used QLoRA for fine-tuning using the process outlined in https://georgesung.github.io/ai/qlora-ift/ — GPTQ quantized model can be found at digitalpipelines/llama27bchatuncensored-GPTQ — GGML 2, 3, 4, 5, 6 and 8-bit quanitized models for CPU+GPU inference of digitalpipelines/llama27bchatuncensored-GGML
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: digitalpipelines
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 3 | Загрузок: 9
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.