Метка: quantized - Страница 25 - Каталог нейросетей

Метка: quantized

Генерация текста

scottgl/Qwen3.5-122B-A10B-NVFP4-GB10

Qwen3.5-122B-A10B оптимизирован для NVIDIA DGX Spark (GB10, SM12.1) — все квантования встроены. Эта контрольная точка получена из Sehyo/Qwen3.5-122B-A10B-NVFP4...

Генерация текста

baa-ai/MiniMax-M2.7-RAM-100GB-MLX

Сборка MLX смешанной точности MiniMaxAI/MiniMax-M2.7, подготовленная baa.ai. Настройки для обоих прогонов соответствуют рекомендуемым настройкам вывода ниже. MiniMax-M2.7 использует…...

Генерация текста

batiai/gemma-4-E4B-it-GGUF

> Оптимизированное квантование GGUF для google/gemma-4-E4B-it — более крупного варианта Edge Gemma 4 с полной мультимодальной поддержкой (текст...

Генерация текста

mconcat/Qwopus3.5-27B-v3-NVFP4

Квантованная версия Jackrong/Qwopus3.5-27B-v3 смешанной точности (NVFP4/FP8/BF16). Эта контрольная точка сохраняет гибридную архитектуру Qwen3.5 DeltaNet + softmax и головку...

Генерация текста

tokenaii/Horus-1.0-4B-GGUF

— Источник: tokenaii/horus — Исходная модель: Horus-1.0-4B (параметры 4B) — Разработчик: Assem Sabry & TokenAI — Организация: TokenAI...

Генерация текста

ShinePixelOrg/Qwopus3.5-27B-v3-NVFP4

Квантованная версия ShinePixelOrg/Qwopus3.5-27B-v3 со смешанной точностью. Эта контрольная точка сохраняет ту же гибридную архитектуру Qwen3.5 DeltaNet + softmax...

Генерация текста

Brooooooklyn/Qwen3.5-35B-A3B-UD-Q4_K_XL-mlx

4-битное базовое квантование смешанной точности Qwen/Qwen3.5-35B-A3B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...