inclusionAI_Ling-flash-2.0-GGUF
Исходная модель: https://huggingface.co/inclusionAI/Ling-flash-2.0 Все кванты, созданные с использованием опции imatrix с набором данных отсюда, в сочетании с подмножеством...
Исходная модель: https://huggingface.co/inclusionAI/Ling-flash-2.0 Все кванты, созданные с использованием опции imatrix с набором данных отсюда, в сочетании с подмножеством...
Исходная модель: https://huggingface.co/TildeAI/TildeOpen-30b Все кванты, созданные с использованием опции imatrix с набором данных отсюда, в сочетании с подмножеством...
Исходная модель: https://huggingface.co/zerofata/MS3.2-PaintedFantasy-Visage-v3-34B. Все кванты созданы с использованием опции imatrix с набором данных отсюда в сочетании с подмножеством...
Этот репозиторий содержит несколько пользовательских квантов GLM-4.5, которые ориентированы на несколько различных схем по сравнению с обычными схемами...
Llama-3.3-Nemotron-Super-49B-v1.5 представляет собой значительно обновленную версию Llama-3.3-Nemotron-Super-49B-v1 и представляет собой модель большого языка (LLM), которая является производной от...
Для этой коллекции квантов ТРЕБУЕТСЯ форк ikllama.cpp для поддержки последних квантов и оптимизаций SOTA ik! Не** загружайте эти...
Квантование GGUF Doctor-Shotgun/ML2-123B-Magnum-Diamond с использованием llama.cpp. Эта модель соответствует формату подсказок Mistral v7 (не Tekken). Предварительное заполнение не...
Исходная модель: https://huggingface.co/shuttleai/shuttle-3.5. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Исходная модель: https://huggingface.co/Skywork/Skywork-OR1-32B-Preview. Запускайте их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp. Некоторые из...
Наш новейший метод квантования представляет собой высокоточное адаптивное квантование для моделей со сверхмалой разрядностью (1–2 бита) с проверенными...