Cerebras-GPT-111M-instruction
The smallest of cerebras GPT models with only 111M parameters instruction fine-tuned. The model has been evaluated with...
The smallest of cerebras GPT models with only 111M parameters instruction fine-tuned. The model has been evaluated with...
This repository contains custom APEX (Adaptive Precision for EXpert Models) -inspired quants, tuned specifically to the underlying mixture-of-experts...
REAP удаляет 30% экспертов MoE (38 из 128 на каждый уровень), сохраняя при этом поведение маршрутизации модели. Количество...
— Prime Intellect — Для спонсирования вычислений и создания INTELLECT-3 — Cerebras — Для методологии сокращения REAP —...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE 📄 Бумага • 💻 Код • 📝 Блог...
Эта модель была преобразована в формат GGUF из cerebras/Llama3-DocChat-1.0-8B с использованием llama.cpp через пространство GGUF-my-repo ggml.ai. Более подробную...
> [!TIP] > Поддержите эту работу → · X · GitHub · REAP paper · Cerebras REAP 𓌳...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP W4A16,...
> [!IMPORTANT] > Ссылка на исходную модель: saricles/MiniMax-M2.7-REAP-172B-A10B-BF16 > Это модель MiniMax M2.5 с 230 миллиардами параметров, 25%...
Этот репозиторий предоставляет высокоточные квантованные версии модели Qwen3-Coder-REAP-25B-A3B с пользовательской матрицей важности, созданной Em-80 и специально оптимизированной для...