Официальная сборка OsaurusAI MXFP8 Qwen/Qwen-AgentWorld-35B-A3B (Apache-2.0) — гибридный MoE ~35B / ~3B (qwen35moe). 8-битный микромасштабируемый FP практически без потерь; работает на Apple Silicon через Osaurus/mlx_lm. — Пакет ~33 ГБ (по сравнению с ~65 ГБ для bf16). — MXFP8: микромасштабированный FP8 (размер группы 32) по весам, высокоточные вставки/головка. Используйте это для максимальной точности; используйте JANG4M (~17,6 ГБ) для наименьшего размера. — Только текст. Вышестоящая контрольная точка отправляет рудиментарную конфигурацию Vision без весов Vision Tower, поэтому в этом пакете правильно помечена модальность: текст (hasvision: false`). > Рассуждающее поведение. Эта модель показывает свою работу («Мыслительный процесс:…») по умолчанию. Переключатель мягкого подавления /nothink ненадежен в этом пакете MXFP8 — для детерминированных рассуждений отдайте предпочтение пакету JANG4M, который его поддерживает. Уровни Gated-DeltaNet (conv1d/Alog/dtbias/gated inproj{qkv,a,b,z}) переносят повторяющееся состояние через уровни полного внимания, что подтверждено согласованностью с вызовом длинного контекста в среде выполнения Osaurus (vMLX-Swift). Или загрузите Osaurus для локального цикла агента (вызов инструментов поддерживается через анализатор инструментов qwen). — База: Qwen/Qwen-AgentWorld-35B-A3B © Qwen — Apache-2.0…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: OsaurusAI
Теги: mlx, qwen3_5_moe, qwen, world-model, agent, moe, gated-deltanet, linear-attention
Лайков: 5 | Загрузок: 332
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.