GLM-4.7-REAP-268B-A32B-AWQ-4bit
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-268B-A32B, сжатый вариант GLM-4.7 с эффективным использованием...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-268B-A32B, сжатый вариант GLM-4.7 с эффективным использованием...
Исходная модель: https://huggingface.co/cerebras/MiniMax-M2-REAP-162B-A10B Все кванты созданы с использованием опции imatrix с набором данных отсюда в сочетании с подмножеством...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.6-REAP-252B-A32B-FP8, сжатый вариант GLM-4.6-FP8 с эффективным использованием...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP Это...
Это доработанная версия GLM-4.7-Flash-REAP-23B-A3B, созданная по заказу McG-221 с помощью механизма аблитерации Heretic (v1.1.0) компании P-E-W, объединенного с...
Llama-FinSent-S — это доработанная версия oopere/pruned40-llama-1b, урезанной модели, полученной из LLaMA-3.2-1B. Процесс сокращения уменьшает количество нейронов в слоях...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP Это...
𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-268B-A32B-FP8, сжатый вариант GLM-4.7-FP8 с эффективным использованием...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP W4A16,...
𓌳 REAP𓌳 Эксперты: почему сокращение преобладает при однократном сжатии MoE Представляем Qwen3-Coder-REAP-246B-A35B, сжатый вариант Qwen3-Coder-480B-A35B-Instruct с эффективным использованием...