Qwen3-1.7B-FC
A function calling model based on Qwen3-1.7B, fine-tuned using RLVR (Reinforcement Learning with Verifiable Rewards) to improve tool-use...
A function calling model based on Qwen3-1.7B, fine-tuned using RLVR (Reinforcement Learning with Verifiable Rewards) to improve tool-use...
Gitara = git + ara (the parrot genus): your local stochastic parrot for git commands. A 3B parameter...
This model was generated using llama.cpp at commit 6adc3c3e. xLAM series are significant better at many things including...
This model was generated using llama.cpp at commit 6adc3c3e. xLAM series are significant better at many things including...
 Это квантованная версия Groq/Llama-3-Groq-8B-Tool-Use, созданная с использованием llama.cpp. Это версия модели Llama 3 Groq Tool Use...
Этот репозиторий содержит квантование Q4KM GGUF для точной настройки кодирования и использования инструментов на основе unsloth/NVIDIA-Nemotron-3-Nano-4B. — Формат:...
grug раздавить grug-9b о камни GGUF. небольшой камень подходит для небольшой пещеры. весь рок думает, думает грубиян из...
> Неважно, какой у тебя графический процессор. Независимо от вашей оперативной памяти. Имея около 4,5 ГБ видеопамяти или...
Macaron-V1-Preview-744B-Merged — это объединенный вариант Macaron-V1-Preview от MindLab Research с полной контрольной точкой, прошедший пост-обучение из GLM-5.1 с...
ZAYA не является стандартной архитектурой mlxlm. Он чередует уровни внимания CCA и уровни MoE верхнего уровня 1. Используйте...