Чат и поддержка: сервер Discord TheBloke Хотите внести свой вклад? Страница TheBloke на Patreon Работа LLM компании TheBloke щедро поддерживается грантом Андреессена Горовица (a16z) — Создатель модели: OpenAssistant — Исходная модель: Llama2 13B Orca 8K 3319. Этот репозиторий содержит файлы моделей в формате GGML для OpenAssistant’s Llama2 13B Orca 8K 3319. Формат GGML теперь изменен. заменен GGUF. С 21 августа 2023 г. llama.cpp больше не поддерживает модели GGML. Ожидается, что сторонние клиенты и библиотеки будут поддерживать его какое-то время, но многие из них также могут отказаться от поддержки. Файлы GGML предназначены для вывода CPU + GPU с использованием llama.cpp, а также библиотек и пользовательских интерфейсов, поддерживающих этот формат, таких как: text-generation-webui, самый популярный веб-интерфейс. Поддерживает ускорение графического процессора NVidia CUDA. KoboldCpp — мощный веб-интерфейс GGML с ускорением графического процессора на всех платформах (CUDA и OpenCL). Особенно хорош для рассказывания историй. LM Studio, полнофункциональный локальный графический интерфейс с графическим ускорением как для Windows (NVidia и AMD), так и для macOS. LoLLMS Web UI, отличный веб-интерфейс с ускорением графического процессора CUDA через серверную часть ctransformers. ctransformers, библиотека Python с ускорением графического процессора, поддержкой LangChain и OpenAI-совместимым сервером искусственного интеллекта. *…
Модальности:
Генерация текста
Задача: Генерация текста
Автор: TheBloke
Теги: llama, sft, en
Лайков: 53 | Загрузок: 6
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.