4-битная квантованная версия текстовой модели nvfp4 MLX из Qwen/Qwen3.5-397B-A17B. Части этой карты были скопированы или адаптированы из оригинальной модели карты, созданной командой Qwen. Qwen3.5-397B-A17B — это новейшая флагманская языковая модель Alibaba, имеющая гибридную архитектуру, которая сочетает в себе Gated DeltaNet (линейное внимание) и разреженную смесь экспертов для высокопроизводительного вывода. Несмотря на общее количество параметров 397B, на каждый токен активируется только ~17B, что делает его чрезвычайно эффективным для своего уровня возможностей. Это преобразование обеспечивает 4-битную квантованную версию, содержащую только текст, оптимизированную для локального вывода на компьютерах Apple Silicon Mac через платформу MLX. Видеокодер из оригинальной мультимодальной модели в комплект не входит — для понимания изображения/видео обратитесь к оригинальному Qwen/Qwen3.5-397B-A17B. — 201 язык и диалект с глубоким культурным и региональным пониманием — 262 тыс. родного контекста (расширяется до 1 млн+ с помощью YaRN) — Режим мышления с цепочкой мыслей (…) — Использование инструментов и агентские рабочие процессы (MCP, вызов функций) — Конкурентные тесты: MMLU-Pro 87.8, SuperGPQA 70.4, C-Eval 93.0 Маршрутизаторы MoE (mlp.gate) и mlp.sharedexpertgate для всех 60 слоев) хранятся по адресу…
Модальности:
Генерация текста
Области применения:
Диалог / чат Мультиязычность
Задача: Генерация текста
Автор: mlx-community
Теги: mlx, qwen3_5_moe, 4bit, nvfp4, quantized, moe, mixture-of-experts, conversational
Лайков: 5 | Загрузок: 177
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.