Hy3-REAP-48e
Экспертно-обрезанная версия tencent/Hy3, созданная с помощью REAP (экспертная обрезка активации с учетом маршрутизатора). 192 маршрутизируемых эксперта каждого уровня...
Экспертно-обрезанная версия tencent/Hy3, созданная с помощью REAP (экспертная обрезка активации с учетом маршрутизатора). 192 маршрутизируемых эксперта каждого уровня...
DeepSeek V4 Flash с сокращением REAP на уровне K128 (128 маршрутизируемых экспертов на каждый уровень MoE, сокращение 50%)...
REAP удаляет 30% экспертов MoE (38 из 128 на каждый уровень), сохраняя при этом поведение маршрутизации модели. Количество...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP 20%...
Эта модель была преобразована в формат GGUF из AmanPriyanshu/gpt-oss-6.0b-specialized-all-pruned-moe-only-7-experts с использованием llama.cpp через пространство GGUF-my-repo ggml.ai. Более подробную...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP Это...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP Это...
Проект: https://amanpriyanshu.github.io/GPT-OSS-MoE-ExpertFingerprinting/ Это сокращенный вариант модели OpenAI GPT-OSS-20B, уменьшенный до 4 экспертов на уровень на основе шаблонов активации...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP GGUF-квантование...
13,67 ГБ | 204/256 экспертов | Q3KM | MMLU -1pp, GSM8K равно | Полная резидентность графического процессора на...