Метка: SSM - Каталог нейросетей

Метка: SSM

Генерация текста

aoxo/Ma-layala-mba_Tiny_128M

Добро пожаловать в Ma-layala-mba, базовую языковую модель индейцев, предназначенную для расширения границ НЛП для индийских языков. Он основан...

Генерация текста

Vcecca/mamba-50m

A ~50M-parameter Mamba (selective state-space) causal language model, pretrained from scratch on English Wikipedia. Mamba replaces the attention...

Генерация текста

amazon/GKA-primed-HQwen3-8B-Reasoner

GKA-primed-HQwen3-8B-Reasoner — это гибридная языковая модель, состоящая из 50% слоев внимания и 50% слоев стробированного KalmaNet (GKA), загрунтованных...

Генерация текста

rishi-r-rishi-r/Mintaka-E-170M-HMT

Mintaka Micro — это гибридная базовая модель с 173 миллионами параметров, сочетающая слои модели пространства выборочных состояний (Mamba)...

Генерация текста

limloop/whiff-mamba2-50M-v0.1

> 💾 Версии GGUF доступны в этом же репозитории (limloop/whiff-mamba2-50M-v0.1): > bf16.gguf (brainscale float16) · q80.gguf` (квантованный 8-бит)...

Генерация текста

nvidia/mamba2-hybrid-8b-3t-32k

Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...

Генерация текста

aifeifei798/Mamba3-MIMO-Tiny-HF

!image/png > «Одна из первых HF-совместимых реализаций архитектуры Mamba-3 MIMO». > (全球首批兼容 Обнимающее лицо 的 Мамба-3 MIMO 架构实现之一。)...

Генерация текста

nvidia/gpt3-8b-multi-3.5t-base

Мы выпускаем 8B-параметрическую модель Mamba-2 и Mamba-2-Hybrid (состоящую из слоев Mamba-2, внимания и MLP), обученную для статьи «Эмпирическое...