Qwen3-30B-A3B-GGUF
Using [LLaMA C++][llm] release [b5580][llm-rel] for quantization. > Qwen3 is the latest generation of large language models in...
Using [LLaMA C++][llm] release [b5580][llm-rel] for quantization. > Qwen3 is the latest generation of large language models in...
Использование нестандартной (разветвленной) версии [LLaMA C++][llm] [b8927][llm-rel] для квантования. От создателей исходной модели: > # Qwen3.5-9B > >...
Использование версии [LLaMA C++][llm] [b5540][llm-rel] для квантования. > Условия использования: Условия > > Авторы: Google DeepMind > >...
> What-tool-8B — это доработанная языковая модель, основанная на LLaMa-3.1-8B-Instruct, оптимизированная для использования инструментов и многоходового диалога. Он...
Использование [LLaMA C++][llm] выпуска [b5600][llm-rel] для квантования. Исходная модель: [cognitivecomputations/Dolphin-Mistral-24B-Venice-Edition][mdl] >  > Discord: https://discord.gg/h3K4XGj2RH > Веб-сайт: https://dphn.ai...
GPTQ 4-битное 128-групповое квантование https://huggingface.co/digitous/13B-HyperMantis Модальности:Генерация текста Задача: Генерация текста Автор: digitous Теги: llama, alpaca, mix, gptq, quant,...