Метка: pruning - Страница 2 - Каталог нейросетей

Метка: pruning

Генерация текста

cyankiwi/GLM-4.7-REAP-268B-A32B-AWQ-4bit

𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-268B-A32B, сжатый вариант GLM-4.7 с эффективным использованием...

Генерация текста

bartowski/cerebras_MiniMax-M2-REAP-162B-A10B-GGUF

Исходная модель: https://huggingface.co/cerebras/MiniMax-M2-REAP-162B-A10B Все кванты созданы с использованием опции imatrix с набором данных отсюда в сочетании с подмножеством...

Генерация текста

cerebras/GLM-4.6-REAP-252B-A32B-FP8

𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.6-REAP-252B-A32B-FP8, сжатый вариант GLM-4.6-FP8 с эффективным использованием...

Генерация текста

oopere/Llama-FinSent-S

Llama-FinSent-S — это доработанная версия oopere/pruned40-llama-1b, урезанной модели, полученной из LLaMA-3.2-1B. Процесс сокращения уменьшает количество нейронов в слоях...

Генерация текста

cerebras/GLM-4.7-REAP-268B-A32B-FP8

𓌳 REAP𓌳 Эксперты: почему обрезка преобладает при однократном сжатии MoE Представляем GLM-4.7-REAP-268B-A32B-FP8, сжатый вариант GLM-4.7-FP8 с эффективным использованием...

Генерация текста

cerebras/Qwen3-Coder-REAP-246B-A35B

𓌳 REAP𓌳 Эксперты: почему сокращение преобладает при однократном сжатии MoE Представляем Qwen3-Coder-REAP-246B-A35B, сжатый вариант Qwen3-Coder-480B-A35B-Instruct с эффективным использованием...