Метка: imatrix - Страница 11 - Каталог нейросетей

Метка: imatrix

Генерация текста

bartowski/Llama-3.1-70B-ArliAI-RPMax-v1.3-GGUF

Оригинальная модель: https://huggingface.co/ArliAI/Llama-3.1-70B-ArliAI-RPMax-v1.3 Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) являются стандартным методом квантования с вложениями...

Генерация текста

bartowski/Qwen2.5-72B-0.6x-Instruct-GGUF

Исходная модель: https://huggingface.co/ddh0/Qwen2.5-72B-0.6x-Instruct Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) используют стандартный метод квантизации, при котором...

Генерация текста

bartowski/Chronos-Platinum-72B-GGUF

Оригинальная модель: https://huggingface.co/ZeusLabs/Chronos-Platinum-72B Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) являются стандартным методом квантования с вложениями...

Генерация текста

Quant-Cartel/Acolyte-22B-iMat-GGUF

Матрица важности рассчитана с использованием groupsmerged.txt 105 фрагментов nctx=512 В расчетах используются веса прецизионной модели fp32 LoRA группы...

Генерация текста

bartowski/Llama-3.1-70B-ArliAI-RPMax-v1.1-GGUF

Исходная модель: https://huggingface.co/ArliAI/Llama-3.1-70B-ArliAI-RPMax-v1.1 Некоторые из этих квантов (Q3KXL, Q4KL и т. д.) представляют собой стандартный метод квантования, в...

Генерация текста

legraphista/DeepSeek-V2.5-IMat-GGUF

Исходная модель: deepseek-ai/DeepSeek-V2.5 Исходный тип dtype: BF16 (bfloat16) Квантизация: llama.cpp b3675 Набор данных IMatrix: здесь — Файлы —...

Генерация текста

bartowski/magnum-32b-v1-GGUF

Исходная модель: https://huggingface.co/anthracite-org/magnum-32b-v1 Спасибо kalomaze и Dampf за помощь в создании набора калибровочных данных imatrix. Спасибо ZeroWw за...