Qwable-9B-Claude-Fable-5-SHQ8-GGUF
> Семейство адаптивного квантования для гибридной архитектуры Qwen3.5-9B Gated DeltaNet + Full Attention. Каждый вариант использует реальные данные...
> Семейство адаптивного квантования для гибридной архитектуры Qwen3.5-9B Gated DeltaNet + Full Attention. Каждый вариант использует реальные данные...
калиброванный imatrix IQ3_XXS для nex-agi/Nex-N2-mini. 13,6 ГБ на диске, помещается в 15 ГБ памяти графического процессора с местом для контекста....
Nex-N2-mini с квантованием NVFP4 (тонкая настройка Qwen3.5-MoE-35B), оптимизированная для NVIDIA Blackwell (SM 12.1), обслуживающая через vLLM с ядрами...
4-битное (AWQ W4A16, только для экспертов) квантование MiMo-V2.5, упакованное для работы на NVIDIA A100 (SM80) под стандартной версией...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: RazielXYZ Теги: qwen3_5_moe, quantized, fp4,...
Квантованные версии AIDC-AI/Marco-DeepResearch-8B с матрицей важности (imatrix) GGUF для использования с llama.cpp и совместимыми механизмами вывода. Для стандартных...
Квантованные версии GGUF AIDC-AI/Marco-DeepResearch-8B для использования с llama.cpp и совместимыми механизмами вывода. Marco DeepResearch — это эффективный агент...
> Квантование GPTQ INT4 Qwen/Qwen3.6-27B. > в 3 раза меньше. ~2,4× быстрее. Однопоточное измерение на том же оборудовании,...
Это кванты для механизма вывода DS4, построенного на основе матрицы важности (imatrix) и смещений тензора, выровненных для эффективной...
> Una AI, который живет в твоей машине. Больше скорости, больше возможностей, больше мате. > Пор Гонсало Рокка...