Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области LLM щедро поддерживается грантом от Андреессена Горовица (a16z) — Создатель модели: Институт технологических инноваций — Исходная модель: Falcon 180B. Этот репозиторий содержит файлы моделей GPTQ для Falcon 180B Института технологических инноваций. Предусмотрено несколько перестановок параметров GPTQ; Подробную информацию о предоставляемых опциях, их параметрах и программном обеспечении, использованном для их создания, см. ниже в разделе «Предоставленные файлы». Из-за огромного размера модели GPTQ был сегментирован. Это нарушит совместимость с AutoGPTQ и, следовательно, с любыми клиентами и библиотеками, которые используют AutoGPTQ напрямую. Но они прекрасно работают при загрузке непосредственно через Transformers — и могут обслуживаться с помощью вывода генерации текста! В настоящее время известно, что эти GPTQ работают с: — Transformers 4.33.0 — Text Generation Inference (TGI) версии 1.0.4 — Docker-контейнером: ghcr.io/huggingface/text-generation-inference: новейшие модели GPTQ для вывода GPU с несколькими вариантами параметров квантования. 2, 3, 4, 5, 6 и 8-битные модели GGUF для вывода CPU+GPU * Оригинальная неквантованная модель fp16 Института технологических инноваций в pytorch…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: TheBloke
Теги: falcon, en, de, es, fr, text-generation-inference, 4-bit, gptq
Лайков: 10 | Загрузок: 8
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.