Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области LLM щедро поддерживается грантом от Андреессена Горовица (a16z) — Создатель модели: CodeFuse AI — Исходная модель: CodeFuse CodeLlama 34B. Этот репозиторий содержит файлы моделей GPTQ для CodeFuse CodeLlama 34B от CodeFuse AI. Предусмотрено несколько перестановок параметров GPTQ; Подробную информацию о предоставляемых опциях, их параметрах и программном обеспечении, использованном для их создания, см. ниже в разделе «Предоставленные файлы». Модель(и) AWQ для вывода с помощью графического процессора. Модели GPTQ для вывода графического процессора с несколькими вариантами параметров квантования. 2, 3, 4, 5, 6 и 8-битные модели GGUF для вывода CPU+GPU Исходная неквантованная модель fp16 CodeFuse AI в формате pytorch для вывода GPU и дальнейших преобразований. Создатель исходной модели указал свою лицензию как другую, и поэтому для этого квантования использовалась та же лицензия. Поскольку эта модель основана на Llama 2, на нее также распространяются условия лицензии Meta Llama 2, файлы лицензии для которой включены дополнительно. Следовательно, его следует рассматривать как заявленный как лицензированный по обеим лицензиям. Я связался с Hugging Face за разъяснениями по поводу двойного лицензирования, но…
Модальности:
Генерация текста
Области применения:
Генерация кода
Задача: Генерация текста
Автор: TheBloke
Теги: llama, text-generation-inference, 4-bit, gptq
Лайков: 9 | Загрузок: 15
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.