lucianosb/llama-2-7b-langchain-chat-GGUF - Каталог нейросетей
Генерация текста

lucianosb/llama-2-7b-langchain-chat-GGUF

Добавлено:
lucianosb/llama-2-7b-langchain-chat-GGUF

— Criador do Modelo: Photolens — Оригинал модели: llama-2-7b-langchain-chat Наблюдение: значения оперативной памяти не нажимаются на удаление графического процессора. Если вы хотите освободить графический процессор, необходимо сократить использование оперативной памяти и использовать VRAM. Для составления параметров, документация llama.cpp GGUF — это новый формат, введенный в эксплуатацию llama.cpp 21 августа 2023 года. Это замена GGML, которую больше всего не поддерживает llama.cpp. Основная выгода для GGUF заключается в том, что этот формат является расширенным и обеспечивает будущее, которое связано с большей информацией о модели как метаданные. Он также включает код токенизации, который имеет большое значение, в том числе первый номер, который поддерживает все специальные токены. Это особенно приятно, особенно в моделях, которые используют новые токены и реализуют модели быстрой персонализации. Это список клиентов и библиотек, которые согласованы для поддержки GGUF: — llama.cpp. — text-generation-webui, наиболее широко используемый веб-интерфейс. Поддержка GGUF с ускорением графического процессора через серверные преобразователи — серверная часть llama-cpp-python работает недолго. — KoboldCpp, агора поддерживает GGUF и участвует…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: lucianosb
Теги: gguf, pt, en, es, ru, de, pl, th
Лайков: 12  |  Загрузок: 338

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.