Hy3-REAP-48e
Экспертно-обрезанная версия tencent/Hy3, созданная с помощью REAP (экспертная обрезка активации с учетом маршрутизатора). 192 маршрутизируемых эксперта каждого уровня...
Экспертно-обрезанная версия tencent/Hy3, созданная с помощью REAP (экспертная обрезка активации с учетом маршрутизатора). 192 маршрутизируемых эксперта каждого уровня...
Первый общедоступный вариант MiniMax-M2.7 с обрезанным REAP-40%, выпущенный m51Lab 15 апреля 2026 г. — Метод: REAP (Lasby et...
REAP удаляет 30% экспертов MoE (38 из 128 на каждый уровень), сохраняя при этом поведение маршрутизации модели. Количество...
Это экспертная версия Gemma-4 26B-A4B-it от Google на 20 % с использованием Cerebras REAP (экспертная обрезка активации с учетом...
Squeez-2B — это модель с параметрами 2B, доработанная на основе Qwen 3.5 2B для сокращения выходных данных инструмента...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем Step-3.5-Flash-REAP-149B-A11B, сжатый вариант Step-3.5-Flash с эффективным использованием...
Исходная модель: https://huggingface.co/cerebras/GLM-4.7-REAP-218B-A32B — llama.cpp — LM Studio — koboldcpp — Jan AI — Веб-интерфейс создания текста —...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-218B-A32B, сжатый вариант GLM-4.7 с эффективным использованием...
𓌳 REAP𓌳 Эксперты: почему сокращение преобладает при однократном сжатии MoE Представляем Qwen3-Coder-REAP-363B-A35B, сжатый вариант Qwen3-Coder-480B-A35B-Instruct с эффективным использованием...
Zirel-3 — это специализированная точная настройка cerebras/GLM-4.5-Air-REAP-82B-A12B, модели Mixture-of-Experts (MoE) с активными параметрами (82B) с эффективным использованием памяти,...