OpenYourMind-NVIDIA-Nemotron-3-Ultra-550B-A55B-abliterated-uncensored-NVFP4
☕ Если эти модели вам полезны, рассмотрите возможность поддержки моей работы — это позволит вычислить больше и больше...
☕ Если эти модели вам полезны, рассмотрите возможность поддержки моей работы — это позволит вычислить больше и больше...
Mintaka Micro — это гибридная базовая модель с 173 миллионами параметров, сочетающая слои модели пространства выборочных состояний (Mamba)...
Эта карточка модели будет обновляться практически ежедневно, пока мы в ближайшее время не загрузим версию модели с защитными...
Mamba2-primed-HQwen3-8B-Instruct — это гибридная языковая модель, состоящая из 50 % слоев внимания и 50 % слоев Mamba2, созданных из Qwen3-8B...
Это квантованная версия Ex0bit/Elbaz-NVIDIA-Nemotron-3-Nano-30B-A3B-PRISM NVFP4 (FP4), созданная с использованием оптимизатора моделей NVIDIA TensorRT. Формат NVFP4 оптимизирован для: —...
Замена Pure-PyTorch для NVIDIA Nemotron-Cascade-2-30B-A3B. Удаляет все внешние зависимости ядра CUDA (mamba-ssm, causal-conv1d) и заменяет их собственными операциями...
Цель. Гибридная языковая модель Mixture of Experts с ~10 миллиардами параметров и ~2 миллиардами активных параметров на токен....
Мы выявили и исправили проблему, связанную с неправильной перестановкой некоторых прогнозов, которая влияет на качество генерации. Чтобы использовать...
Эта модель представляет собой удаленную (без цензуры) версию nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16, в которой механизмы отказа были удалены с помощью PRISM...
Мы выявили и исправили проблему, связанную с неправильной перестановкой некоторых прогнозов, которая влияет на качество генерации. Чтобы использовать...