This is Llama-3.1_OpenScholar-8B with AWQ Quantization applied using the following code.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: NeuML
Теги: llama, llama-3.1, autoawq, conversational, en, text-generation-inference, endpoints_compatible, 4-bit
Лайков: 3 | Загрузок: 28
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.