Это полностью 4-битная (размер группы = 64) квантованная модель HQQ Hermes-3-Llama-3.1-70B. Размер модели и скорость декодирования должны быть аналогичны версии Llama-3.1-70b-instruct4bitgs64hqq. Кроме того, убедитесь, что вы используете как минимум Torch 2.4.0 или ночную сборку.
Модальности:
Генерация текста
Задача: Генерация текста
Автор: mobiuslabsgmbh
Лайков: 4 | Загрузок: 6
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.