Soofi-S-Isar-Preview
> ⚠️Превью/внутренняя проходная. Веса и метаданные могут измениться. Soofi-S-Isar-Preview генерирует текстовые ответы с четкими рассуждениями перед окончательным ответом....
> ⚠️Превью/внутренняя проходная. Веса и метаданные могут измениться. Soofi-S-Isar-Preview генерирует текстовые ответы с четкими рассуждениями перед окончательным ответом....
> ⚠️Превью/внутренняя проходная. Веса и метаданные могут измениться. Soofi-S-Rhine-Preview генерирует текстовые ответы с четкими рассуждениями перед окончательным ответом....
Mamba2-primed-HQwen3-8B-Instruct — это гибридная языковая модель, состоящая из 50 % слоев внимания и 50 % слоев Mamba2, созданных из Qwen3-8B...
Это квантованная версия Ex0bit/Elbaz-NVIDIA-Nemotron-3-Nano-30B-A3B-PRISM NVFP4 (FP4), созданная с использованием оптимизатора моделей NVIDIA TensorRT. Формат NVFP4 оптимизирован для: —...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...
Эта модель представляет собой удаленную (без цензуры) версию nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16, в которой механизмы отказа были удалены с помощью PRISM...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...