Qwen3.6-35B-A3B-TQ-apex3
Data-driven mixed-precision native TurboQuant checkpoint of Qwen/Qwen3.6-35B-A3B. Extends -TQ-apex2 by skipping the shared-expert down-projection — the tensor family...
Data-driven mixed-precision native TurboQuant checkpoint of Qwen/Qwen3.6-35B-A3B. Extends -TQ-apex2 by skipping the shared-expert down-projection — the tensor family...
This repo packages the current best TurboQuant runtime recipe we have measured for mlx-community/Qwen3.5-9B-MLX-4bit: TurboQuant 3-bit KV-cache compression...
— Development: Code assistance and generation — Writing: Content creation and editing — Analysis: Document summarization — Chat:...
MoE с 284 байтами параметров (активный 21 байт) в 95 ГиБ — подходит и работает на блоках с...
Плотная модель с 27B параметрами и квантованием смешанной точности Config-I. Стандартный формат MLX — работает со стандартными mlxlm...
3-битная версия MLX с квантованием по весу Qwen/Qwen3.6-35B-A3B с квантованием KV-кэша TurboQuant. Оптимизирован для вывода Apple Silicon через...
♥ Модель с ускоренным выводом MTP, оптимизированная для графических процессоров с видеопамятью 16 ГБ. ♥ Эта модель представляет...
TQ34S` — это 3,5-битный весовой формат с преобразованием Уолша-Адамара с четырьмя шкалами по 8 на блок по 32...
35B-параметр MoE сжат до 15 ГБ с помощью квантования смешанной точности Config-I. Стандартный формат MLX — работает со...
93,5% MMLU при 87 ГБ. Декодирование 61 ток/с. ЗГЗ 4.604. 228B-параметр MoE сжат на 62% с помощью квантования...