abhinavkulkarni/VMware-open-llama-13b-open-instruct-w4-g128-awq - Каталог нейросетей
Генерация текста

abhinavkulkarni/VMware-open-llama-13b-open-instruct-w4-g128-awq

Добавлено:
abhinavkulkarni/VMware-open-llama-13b-open-instruct-w4-g128-awq

Настроенная по инструкции версия полностью обученной модели Open LLama 13B. Эта модель представляет собой 4-разрядную 128-групповую квантованную модель AWQ. Для получения дополнительной информации о квантовании AWQ, пожалуйста, нажмите здесь. Эта модель была успешно протестирована на драйвере CUDA v530.30.02 и среде выполнения v11.7 с Python v3.10.11. Обратите внимание, что для AWQ требуются графические процессоры NVIDIA с вычислительной мощностью 8,0 или выше. Для пользователей Docker образ nvcr.io/nvidia/pytorch:23.06-py3 является средой выполнения v12.1, но в остальном идентичен конфигурации выше, а также проверен на работоспособность. Если вы нашли OpenLLaMA полезным в своих исследованиях или приложениях, пожалуйста, укажите, используя следующий BibTeX: Модель была квантована с помощью метода AWQ. Если вы считаете, что AWQ полезен или имеет отношение к вашему исследованию, пожалуйста, процитируйте документ:

Модальности:
Генерация текста

Области применения:
Следование инструкциям


Задача: Генерация текста
Автор: abhinavkulkarni
Теги: llama, AWQ, en, text-generation-inference
Лайков: 3  |  Загрузок: 24

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.