Qwen3.6-27B-A3B-Coder
Уменьшение числа экспертов-специалистов по коду из Qwen3.6-35B-A3B: количество экспертов MoE уменьшено с 256 до 184 (72 удалено на...
Уменьшение числа экспертов-специалистов по коду из Qwen3.6-35B-A3B: количество экспертов MoE уменьшено с 256 до 184 (72 удалено на...
Эти модели создаются и обслуживаются на арендованных графических процессорах. Если вы хотите выразить некоторую признательность, подписка на X...
4-битное квантование MXFP4 Ornith-1.0-397B, созданное с помощью qstream. Только перенаправленные эксперты MoE (~95% весов) квантуются в MXFP4; все,...
Этот репозиторий содержит 4-битную квантованную сборку Jiunsong/SuperQwen-AgentWorld-35B-A3B, удаленную. Номера тестов и подробности проверки см. в родительском репозитории BF16....
Официальная сборка OsaurusAI MXFP8 Qwen/Qwen-AgentWorld-35B-A3B (Apache-2.0) — гибридный MoE ~35B / ~3B (qwen35moe). 8-битный микромасштабируемый FP практически без...
> ⚠️ Тестовый запуск. Это ранняя экспериментальная контрольная точка, а не законченная модель. Тонкая настройка QLoRA объединена с...
🚨⚠️ Я ДОСТИГЛ ОГРАНИЧЕНИЯ БЕСПЛАТНОГО ХРАНЕНИЯ HUGGING FACE ⚠️🚨 Я больше не могу загружать новые модели, если не...
Nex-N2-mini с квантованием NVFP4 (тонкая настройка Qwen3.5-MoE-35B), оптимизированная для NVIDIA Blackwell (SM 12.1), обслуживающая через vLLM с ядрами...
Модель генерации текста Модальности:Генерация текста Области применения:Диалог / чат Задача: Генерация текста Автор: RazielXYZ Теги: qwen3_5_moe, quantized, fp4,...
Это текстовое квантование oMLX oQ4 ericpandev/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive-bf16. — Квантизатор: oMLX oQ — Уровень: oQ4 — Размер группы: 64 —...