Метка: quantized - Страница 28 - Каталог нейросетей

Метка: quantized

Генерация текста

geoffmunn/Qwen3-4B-f16

Это квантованная GGUF версия языковой модели Qwen/Qwen3-4B — мощного LLM с 4 миллиардами параметров из серии Qwen от...

Генерация текста

2imi9/gpt-oss-20B-NVFP4A16-BF16

— Архитектура модели: openai/gpt-oss-20b (Mixture of Experts, контекст 128 КБ) — Параметры: 20 миллиардов (квантованные из исходного MXFP4...

Генерация текста

nvidia/Qwen3-235B-A22B-FP8

Модель NVIDIA Qwen3-235B-A22B FP8 представляет собой квантованную версию модели Qwen3-235B-A22B от Alibaba, которая представляет собой авторегрессионную языковую модель,...

Генерация текста

RedHatAI/Qwen3-8B-quantized.w4a16

— Архитектура модели: Qwen3ForCausalLM — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Весовое квантование:...

Генерация текста

MaziyarPanahi/Qwen3-30B-A3B-GGUF

MaziyarPanahi/Qwen3-30B-A3B-GGUF содержит файлы моделей формата GGUF для Qwen/Qwen3-30B-A3B. GGUF — это новый формат, представленный командой llama.cpp 21 августа...

Генерация текста

MaziyarPanahi/Pleias-Nano-GGUF

— Создатель модели: PleIAs — Исходная модель: PleIAs/Pleias-Nano MaziyarPanahi/Pleias-Nano-GGUF содержит файлы моделей формата GGUF для Pleias/Pleias-Nano. GGUF —...

Генерация текста

RedHatAI/Meta-Llama-3.1-8B-quantized.w8a8

— Архитектура модели: Meta-Llama-3 — Входные данные: текст — Выходные данные: текст — Оптимизация модели: — Квантование активации:...

Генерация текста

legraphista/Llama-Guard-3-8B-IMat-GGUF

Llama.cpp imatrix квантование мета-ламы/Llama-Guard-3-8B Исходная модель: мета-llama/Llama-Guard-3-8B Исходный тип dtype: BF16 (bfloat16) Квантизация: llama.cpp b3447 Набор данных IMatrix:...

Генерация текста

legraphista/glm-4-9b-chat-IMat-GGUF

Исходная модель: THUDM/glm-4-9b-chat Исходный тип dtype: BF16 (bfloat16) Квантизация: https://github.com/ggerganov/llama.cpp/pull/6999 Набор данных IMatrix: здесь — Файлы — IMatrix...