Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа TheBloke в области LLM щедро поддерживается грантом от Андреессена Горовица (a16z). Эти файлы представляют собой 4-битные файлы моделей GPTQ для исследования H2OGPT H2O OASST1 LLaMa 65B. Это результат квантования до 4 бит с использованием GPTQ-for-LLaMa. 4-битные модели GPTQ для вывода на основе графического процессора. 2, 3, 4, 5, 6 и 8-битные модели GGML для вывода на основе процессора и графического процессора. * Неквантованная модель fp16 в формате pytorch, для вывода на основе графического процессора и для дальнейших преобразований. Убедитесь, что вы используете последнюю версию text-generation-webui. 1. Перейдите на вкладку «Модель». 2. В разделе «Загрузить пользовательскую модель или LoRA» введите TheBloke/h2ogpt-research-oasst1-llama-65B-GPTQ. 3. Нажмите «Загрузить». 4. Начнется загрузка модели. По завершении появится сообщение «Готово». 5. В левом верхнем углу щелкните значок обновления рядом с надписью «Модель». 6. В раскрывающемся списке «Модель» выберите только что загруженную модель: h2ogpt-research-oasst1-llama-65B-GPTQ 7. Модель автоматически загрузится и теперь готова к использованию! 8. Если вам нужны какие-либо пользовательские настройки, установите их, а затем нажмите «Сохранить настройки для этой модели», а затем «Обновить модель» в правом верхнем углу. Обратите внимание, что вам не нужно и не следует устанавливать…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: TheBloke
Теги: llama, text-generation-inference, 4-bit, gptq
Лайков: 5 | Загрузок: 11
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.