gemma-4-12B-it-GGUF
Четыре контрольные точки GGUF для llama.cpp: от 4,04 ГБ до 12,67 ГБ. Начните с M: 6,72 ГБ и...
Четыре контрольные точки GGUF для llama.cpp: от 4,04 ГБ до 12,67 ГБ. Начните с M: 6,72 ГБ и...
> Создан на основе mlx-optiq, собственного набора инструментов MLX для квантования, точной настройки и обслуживания LLM локально на...
Сборка MLX смешанной точности Qwen/Qwen3.6-27B, подготовленная baa.ai. В соответствии с нашей внутренней политикой оценки в обоих режимах декодирования...
Сборка MLX смешанной точности Qwen/Qwen3.6-35B-A3B, подготовленная baa.ai. Построено в прогнозируемой глобальной (максимальное качество) рабочей точке. Модальности:Генерация текста Области...
> Важно: эта модель использует формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В настоящее...
Сборка MLX смешанной точности MiniMaxAI/MiniMax-M2.7, подготовленная baa.ai. Настройки для обоих прогонов соответствуют рекомендуемым настройкам вывода ниже. MiniMax-M2.7 использует…...
Квантованная версия Jackrong/Qwopus3.5-27B-v3 смешанной точности (NVFP4/FP8/BF16). Эта контрольная точка сохраняет гибридную архитектуру Qwen3.5 DeltaNet + softmax и головку...
Квантованная версия ShinePixelOrg/Qwopus3.5-27B-v3 со смешанной точностью. Эта контрольная точка сохраняет ту же гибридную архитектуру Qwen3.5 DeltaNet + softmax...
> Важно: в этой модели используется формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В...
MLX Studio — единственное приложение, которое изначально поддерживает модели JANG с рассуждением Nemotron-Cascade-2-30B-A3B — JANG_4M (4,1-битное, 8-битное внимание)...