TheBloke/Alpaca-Lora-30B-GGML - Каталог нейросетей
Генерация текста

TheBloke/Alpaca-Lora-30B-GGML

Добавлено:
TheBloke/Alpaca-Lora-30B-GGML

Чат и поддержка: мой новый сервер Discord Хотите внести свой вклад? Страница TheBloke на Patreon Эти файлы представляют собой файлы моделей в формате GGML для Alpaca LoRA 30B от Chansung. Файлы GGML предназначены для вывода CPU + GPU с использованием llama.cpp, а также библиотек и пользовательских интерфейсов, которые поддерживают этот формат, например: text-generation-webui KoboldCpp ParisNeo/GPT4All-UI llama-cpp-python * 4-битные модели GPTQ ctransformers elinas для вывода GPU 4-битные, 5-битные и 8-битные модели GGML для вывода CPU+GPU * Неквантованная модель fp16 от Chansung в формате pytorch, для вывода графического процессора и дальнейших преобразований. llama.cpp недавно внес еще одно радикальное изменение в свои методы квантования — https://github.com/ggerganov/llama.cpp/pull/1508. Я квантовал файлы GGML в этом репозитории с последней версией. Поэтому для их использования вам потребуется llama.cpp, скомпилированный 19 мая или позже (коммит 2d5db48 или позже). Я использую следующую командную строку; Отрегулируйте по своему вкусу и потребностям: измените -t 10 на количество имеющихся у вас физических ядер ЦП. Например, если ваша система имеет 8 ядер/16 потоков, используйте -t 8. Измените -ngl 32 на количество слоев, которые нужно выгрузить на графический процессор. Удалите его, если у вас нет ускорения графического процессора. Если вы хотите поговорить в стиле чата…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: TheBloke
Теги: alpaca, llama, chat, text2text-generation, en
Лайков: 4  |  Загрузок: 0

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.