Точная настройка Llama-2 13B, обученная с использованием нецензурированного/нефильтрованного набора данных разговора Волшебника-Викуньи digitalpipelines/wizardvicuna70k_uncensored. QLoRA был создан и использован для точной настройки, а затем снова объединен с моделью. Llama2 унаследовала предвзятость, хотя она была точно настроена на наборе данных без цензуры. Модель GPTQ для использования с графическим процессором. Доступны несколько вариантов квантования. Различные размеры квантования модели GGML для использования CPU/GPU/Apple M1. * Исходная неквантованная модель
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: digitalpipelines
Теги: llama, uncensored, wizard, vicuna, en, endpoints_compatible
Лайков: 4 | Загрузок: 8
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.