Qwen3-4B-f16
Это квантованная GGUF версия языковой модели Qwen/Qwen3-4B — мощного LLM с 4 миллиардами параметров из серии Qwen от...
Это квантованная GGUF версия языковой модели Qwen/Qwen3-4B — мощного LLM с 4 миллиардами параметров из серии Qwen от...
— Архитектура модели: openai/gpt-oss-20b (Mixture of Experts, контекст 128 КБ) — Параметры: 20 миллиардов (квантованные из исходного MXFP4...
Модель NVIDIA Qwen3-235B-A22B FP8 представляет собой квантованную версию модели Qwen3-235B-A22B от Alibaba, которая представляет собой авторегрессионную языковую модель,...
— Архитектура модели: Qwen3ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...
MaziyarPanahi/Qwen3-30B-A3B-GGUF содержит файлы моделей формата GGUF для Qwen/Qwen3-30B-A3B. GGUF — это новый формат, представленный командой llama.cpp 21 августа...
— Создатель модели: PleIAs — Исходная модель: PleIAs/Pleias-Nano MaziyarPanahi/Pleias-Nano-GGUF содержит файлы моделей формата GGUF для Pleias/Pleias-Nano. GGUF —...
Точно настроен на обширном наборе данных разговоров и удален для свободы использования. Способен генерировать текст, похожий на человека,...
— Архитектура модели: Meta-Llama-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование активации:...
Llama.cpp imatrix квантование мета-ламы/Llama-Guard-3-8B Исходная модель: мета-llama/Llama-Guard-3-8B Исходный тип dtype: BF16 (bfloat16) Квантизация: llama.cpp b3447 Набор данных IMatrix:...
Исходная модель: THUDM/glm-4-9b-chat Исходный тип dtype: BF16 (bfloat16) Квантизация: https://github.com/ggerganov/llama.cpp/pull/6999 Набор данных IMatrix: здесь — Файлы — IMatrix...