Ma-layala-mba_Tiny_128M
Добро пожаловать в Ma-layala-mba, базовую языковую модель индейцев, предназначенную для расширения границ НЛП для индийских языков. Он основан...
Добро пожаловать в Ma-layala-mba, базовую языковую модель индейцев, предназначенную для расширения границ НЛП для индийских языков. Он основан...
A ~50M-parameter Mamba (selective state-space) causal language model, pretrained from scratch on English Wikipedia. Mamba replaces the attention...
GKA-primed-HQwen3-8B-Reasoner — это гибридная языковая модель, состоящая из 50% слоев внимания и 50% слоев стробированного KalmaNet (GKA), загрунтованных...
BitMamba-2-255M is the ultra-efficient baseline model of the BitMamba-2 family. It integrates 1.58-bit ternary quantization (BitNet) into the...
Mintaka Micro — это гибридная базовая модель с 173 миллионами параметров, сочетающая слои модели пространства выборочных состояний (Mamba)...
> 💾 Версии GGUF доступны в этом же репозитории (limloop/whiff-mamba2-50M-v0.1): > bf16.gguf (brainscale float16) · q80.gguf` (квантованный 8-бит)...
Mamba2-primed-HQwen3-8B-Instruct — это гибридная языковая модель, состоящая из 50 % слоев внимания и 50 % слоев Mamba2, созданных из Qwen3-8B...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...
!image/png > «Одна из первых HF-совместимых реализаций архитектуры Mamba-3 MIMO». > (全球首批兼容 Обнимающее лицо 的 Мамба-3 MIMO 架构实现之一。)...
Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...