Эта модель была конвертирована в формат GGUF из токенов HF1BitLLM/Llama3-8B-1.58-100B с помощью llama.cpp. Шаг 2. Перейдите в папку llama.cpp и создайте ее с флагом LLAMACURL=1 вместе с другими флагами, зависящими от оборудования (например: LLAMACUDA=1 для графических процессоров Nvidia в Linux).
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: brunopio
Теги: gguf, llama, conversational, text-generation-inference, endpoints_compatible, 8-bit, bitnet
Лайков: 20 | Загрузок: 2,194
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.