Phi-4-reasoning-plus-GGUF
Наш последний метод квантования вводит прецизионно-адаптивное квантование для сверхнизкоразрядных моделей (1-2 бита) с проверенными улучшениями на Llama-3-8B. Этот...
Наш последний метод квантования вводит прецизионно-адаптивное квантование для сверхнизкоразрядных моделей (1-2 бита) с проверенными улучшениями на Llama-3-8B. Этот...
Эта модель lmstudio-community/Phi-4-mini-reasoning-MLX-4bit была преобразована в формат MLX из microsoft/Phi-4-mini-reasoning с использованием mlx-lm версии 0.24.0. Модальности:Генерация текста Области...
Оригинальная модель: https://huggingface.co/microsoft/Phi-4-reasoning Запустите их напрямую с помощью llama.cpp или любого другого проекта на основе llama.cpp Некоторые из...
ViCoder-HTML-32B-preview is a powerful AI model designed to generate full websites, including HTML, Tailwind CSS, and JavaScript. This...
Selecting the correct model format depends on your hardware capabilities and memory constraints. — A 16-bit floating-point format...
> Alpha-UMa-Qwen-14B is based on the Qwen 2.5 14B modality architecture, designed to enhance coding efficiency and computational...
Bifröst-27B — это передовая модель искусственного интеллекта, построенная на архитектуре gemma3, специально настроенная для безопасной и эффективной генерации...
> Gauss-Opus-14B-R999 is based on the Qwen 2.5 14B modality architecture, designed to enhance mathematical and constructive reasoning...
This model was converted to GGUF format from Qwen/Qwen2.5-Coder-7B-Instruct using llama.cpp via the ggml.ai’s GGUF-my-repo space. Refer to...
Pegasus-Opus-14B-Exp is based on the Qwen 2.5 14B modality architecture, designed to enhance the reasoning capabilities of 14B-parameter...