MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-OptiQ-4bit
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
ZAYA не является стандартной архитектурой mlxlm. Он чередует уровни внимания CCA и уровни MoE верхнего уровня 1. Используйте...
> «Мощь агентного кодирования, теперь открытая для всех» — откалиброванное imatrix квантование GGUF Qwen/Qwen3.6-35B-A3B (только текст) для искусственного...
> Важно: эта модель использует формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В настоящее...
> Оптимизированное квантование GGUF для google/gemma-4-E4B-it — более крупного варианта Edge Gemma 4 с полной мультимодальной поддержкой (текст...
> [!ВАЖНО] > Уведомление об именовании (10 апреля 2026 г.). Метод «HLWQ», используемый в этой модели, переименовывается в...
> Важно: в этой модели используется формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В...
MLX Studio — единственное приложение, которое изначально поддерживает модели JANG с рассуждением Nemotron-Cascade-2-30B-A3B — JANG_4M (4,1-битное, 8-битное внимание)...
Квантование zai-org/GLM-5.2 смешанной точности Apple Silicon (MLX) — модель смеси экспертов с параметрами 744B (~40B активная) с MLA...