Чат Предусмотрено несколько перестановок параметров GPTQ; см. Предоставленные файлы ниже для получения подробной информации о предоставляемых опциях, их параметрах и программном обеспечении, используемом для их создания. Эти файлы были квантованы с использованием оборудования, любезно предоставленного Massed Compute. Модель(и) AWQ для вывода GPU. Модели GPTQ для вывода GPU с несколькими параметрами квантования. 2, 3, 4, 5, 6 и 8-битные модели GGUF для вывода графического процессора Оригинальная бесчисленная модель fp16 KoboldAI в формате pytorch, для вывода графического процессора и для дальнейших преобразований Эти модели GPTQ, как известно, работают на следующих серверах вывода/webuis. — text-generation-webui — KoboldAI United — LoLLMS Web UI — Hugging Face Text Generation Inference (TGI) Это может быть не полный список; если вы знаете других, дайте мне знать! Предусмотрено несколько параметров квантования, чтобы вы могли выбрать лучший для вашего…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: TheBloke
Теги: llama, text-generation-inference, 4-bit, gptq
Лайков: 3 | Загрузок: 13
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.