OpenYourMind-NVIDIA-Nemotron-3-Ultra-550B-A55B-abliterated-uncensored-NVFP4
☕ Если эти модели вам полезны, рассмотрите возможность поддержки моей работы — это позволит вычислить больше и больше...
☕ Если эти модели вам полезны, рассмотрите возможность поддержки моей работы — это позволит вычислить больше и больше...
Mintaka Micro — это гибридная базовая модель с 173 миллионами параметров, сочетающая слои модели пространства выборочных состояний (Mamba)...
> Важно: в этой модели используется формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В...
Mambaoutai является результатом всех экспериментов и тренировок, описанных в следующем сообщении блога, где представлены все подробности о модельном...
> 💾 Версии GGUF доступны в этом же репозитории (limloop/whiff-mamba2-50M-v0.1): > bf16.gguf (brainscale float16) · q80.gguf` (квантованный 8-бит)...
> Важно: в этой модели используется формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В...
MLX-квантование смешанной точности NVIDIA Nemotron-3-Super-120B-A12B — гибридная архитектура Mamba2 + MoE + Attention. Эта модель обеспечивает производительность класса...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...
.custom-table { макет таблицы: исправлено; ширина: 100%; граница-коллапс: коллапс; маржа-верх: 2em; } .custom-table td { ширина: 50%; вертикальное...
Гибридная модель 30B Mamba + MoE с 7,6 ГБ видеопамяти, 15 ток/с, правильный вывод на RTX 4090. Самый...