 Это квантованная версия byroneverson/glm-4-9b-chat-abliterated, созданная с использованием llama.cpp. Пакет Python «tiktoken» необходим для квантования модели в формат gguf. Поэтому мне пришлось создать форк GGUF My Repo (+tiktoken).
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: QuantFactory
Теги: gguf, glm, chatglm, thudm, chat, abliterated, zh, en
Лайков: 5 | Загрузок: 308
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.