Qwen3.5-122B-A10B-NVFP4-GB10
Qwen3.5-122B-A10B оптимизирован для NVIDIA DGX Spark (GB10, SM12.1) — все квантования встроены. Эта контрольная точка получена из Sehyo/Qwen3.5-122B-A10B-NVFP4...
Qwen3.5-122B-A10B оптимизирован для NVIDIA DGX Spark (GB10, SM12.1) — все квантования встроены. Эта контрольная точка получена из Sehyo/Qwen3.5-122B-A10B-NVFP4...
> Важно: эта модель использует формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В настоящее...
Сборка MLX смешанной точности MiniMaxAI/MiniMax-M2.7, подготовленная baa.ai. Настройки для обоих прогонов соответствуют рекомендуемым настройкам вывода ниже. MiniMax-M2.7 использует…...
> Оптимизированное квантование GGUF для google/gemma-4-E4B-it — более крупного варианта Edge Gemma 4 с полной мультимодальной поддержкой (текст...
Квантованная версия Jackrong/Qwopus3.5-27B-v3 смешанной точности (NVFP4/FP8/BF16). Эта контрольная точка сохраняет гибридную архитектуру Qwen3.5 DeltaNet + softmax и головку...
— Источник: tokenaii/horus — Исходная модель: Horus-1.0-4B (параметры 4B) — Разработчик: Assem Sabry & TokenAI — Организация: TokenAI...
> [!ВАЖНО] > Уведомление об именовании (10 апреля 2026 г.). Метод «HLWQ», используемый в этой модели, переименовывается в...
Первое квантование NVFP4 сообщества google/gemma-4-26B-A4B-it — вариант Gemma 4, созданный смешанными экспертами, с общим числом параметров 25,2 млрд...
Квантованная версия ShinePixelOrg/Qwopus3.5-27B-v3 со смешанной точностью. Эта контрольная точка сохраняет ту же гибридную архитектуру Qwen3.5 DeltaNet + softmax...
4-битное базовое квантование смешанной точности Qwen/Qwen3.5-35B-A3B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...