Qwen3.6-28B-REAP20-A3B-GGUF
Квантование GGUF 0xSero/Qwen3.6-28B-REAP20-A3B, 20% экспертного варианта Qwen/Qwen3.6-35B-A3B с использованием метода REAP (взвешенное по маршрутизатору экспертное сокращение активации). 0xSero/Qwen3.6-28B-REAP20-A3B...
Квантование GGUF 0xSero/Qwen3.6-28B-REAP20-A3B, 20% экспертного варианта Qwen/Qwen3.6-35B-A3B с использованием метода REAP (взвешенное по маршрутизатору экспертное сокращение активации). 0xSero/Qwen3.6-28B-REAP20-A3B...
Квантование GGUF 0xSero/gemma-4-21b-a4b-it-REAP, 20% экспертного варианта google/gemma-4-26b-a4b-it с использованием метода REAP (взвешенное по маршрутизатору экспертное сокращение активации). 0xSero/gemma-4-21b-a4b-it-REAP...
Проект: https://amanpriyanshu.github.io/GPT-OSS-MoE-ExpertFingerprinting/ Это сокращенный вариант модели OpenAI GPT-OSS-20B, уменьшенный до 7 экспертов на уровень на основе шаблонов активации...