Эта модель была преобразована в формат MLX и квантована из Qwen3.6-35B-A3B с использованием oMLX. «VL» — это язык видения, что означает, что квантование сохраняет мультимодальность исходной модели. «FP16» — это настройка Apple Silicon M1/M2, которая обеспечивает очень заметное ускорение обработки, поскольку в более старых сериях M отсутствует встроенная аппаратная поддержка BF16. Подробности см. в разделе «Баланс Metal FP32, BF16 и FP16». Отсутствие «FP16» означает, что квантование лучше подходит для M3+ Apple Silicon. [01]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-oQ8 [02]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-oQ6 [03]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-oQ5 [04]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-oQ4 [05]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-VL-oQ8 [06]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-VL-oQ6 [07]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-VL-oQ5 [08]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-VL-oQ4 [09]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-oQ8-FP16 [10]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-oQ6-FP16 [11]: https://huggingface.co/deepsweet/Qwen3.6-35B-A3B-MLX-oQ5-FP16 [12]:…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: deepsweet
Теги: mlx, qwen3_5_moe, conversational, en, 8-bit
Лайков: 5 | Загрузок: 163
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.