gemma-4-31B-it-JANG_1L
Это агрессивное квантование (2-битное среднее значение). На этом уровне сжатия качество вывода заметно ухудшается — ответы могут сначала...
Это агрессивное квантование (2-битное среднее значение). На этом уровне сжатия качество вывода заметно ухудшается — ответы могут сначала...
> Важно: в этой модели используется формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В...
DeepSeek-V4-Flash — 79,6 ГБ на диске (по сравнению с 149 ГБ источника FP4+FP8) — единообразное 2-битное квантование JANGTQ...
Самый маленький MiniMax M2.7 для Apple Silicon — подходит для компьютеров Mac емкостью 96 ГБ и более. >...
> ⚠️ Для запуска требуется MLX Studio. Стандартный mlxlm` не может загружать модели JANG смешанной точности. MLX Studio...