jc-builds/Qwen3.5-9B-Q4_K_M-GGUF - Каталог нейросетей
Генерация текста

jc-builds/Qwen3.5-9B-Q4_K_M-GGUF

Добавлено:
jc-builds/Qwen3.5-9B-Q4_K_M-GGUF

> 4-битный квантованный GGUF Qwen/Qwen3.5-9B, оптимизированный для вывода iOS на устройстве через llama.cpp. Самая мощная модель, которую можно запустить на iPhone. Эта модель доступна непосредственно в приложении HaploAI iOS (v1.18+). Загрузите его со страницы выбора модели. — Лучший в своем классе искусственный интеллект на устройстве: соответствует или превосходит модели, в 9–13 раз превышающие его размер — Режим мышления: … цепочка мыслей — Гибридная архитектура: Gated DeltaNet + Внимание к эффективному и высококачественному выводу — Встроенная мультимодальность: обучение с помощью раннего слияния изображений — Массивный контекст: собственный 262 тыс., расширяемый до 1 млн+ с помощью YaRN Модель 9B превосходит Qwen3-80B на GPQA Diamond (81,7 против 77,2), IFEval (91,5 против 88,9) и математика HMMT (83,2 против 73,7). Он также превосходит GPT-OSS-120B на MMLU-Pro (82,5 против 80,8) и GPQA Diamond (81,7 против 80,1). Модель 9B превосходит специализированный Qwen3-VL-30B (в три раза больше) по MMMU, MMMU-Pro, MathVision, OmniDocBench и VideoMME. > Примечание. Для модели 9B с объемом памяти 5,3 ГБ требуются устройства с оперативной памятью более 8 ГБ. Для более старых устройств используйте Qwen3.5-4B. Qwen3.5 представляет гибридную архитектуру Gated DeltaNet + Gated Attention: — Соотношение 3:1: 3 слоя Gated DeltaNet (линейное внимание) на 1 уровень полного внимания softmax — Всего 32…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: jc-builds
Теги: gguf, qwen, qwen3.5, on-device, ios, mobile, thinking, hybrid-attention
Лайков: 7  |  Загрузок: 5,515

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.