TheDrummer_Big-Alice-28B-v1-GGUF
Исходная модель: https://huggingface.co/TheDrummer/Big-Alice-28B-v1. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Исходная модель: https://huggingface.co/TheDrummer/Big-Alice-28B-v1. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Предупреждение о явном содержании. Поддержка Mawdistical: «Создание «ауры хаоса», подчеркивающей драконовский пыл». Draconia-Overdrive-32B — это выразительная, творческая и...
Исходная модель: https://huggingface.co/PrimeIntellect/INTELLECT-2. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
NEO Imatrix Quants новой модели «Qwen 3 — 32B» с MAX «выходным тензором» на BF16 для улучшения рассуждений/генерации...
УЖАС Imatrix Quants новой модели «Qwen 3 — 14B» с МАКСИМАЛЬНЫМ «выходным тензором» на BF16 для улучшения рассуждений...
Исходная модель: https://huggingface.co/nvidia/Llama-3_1-Nemotron-Ultra-253B-v1. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...
Исходная модель: https://huggingface.co/Sao10K/Llama-3.3-70B-Vulpecula-r1. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...