Метка: linear-attention - Каталог нейросетей

Метка: linear-attention

Генерация текста

prometheusAIR/Ling-3.0-flash-GGUF

Кванты включения AI/Ling-3.0-flash, 127,5В-общая/5,1В-активная гибридная МО (bailinghybrid/BailingMoeV3`). Каждый файл здесь содержит только типы тензоров, безопасные для sm120 —...

Генерация текста

OsaurusAI/Qwen-AgentWorld-35B-A3B-MXFP8

Официальная сборка OsaurusAI MXFP8 Qwen/Qwen-AgentWorld-35B-A3B (Apache-2.0) — гибридный MoE ~35B / ~3B (qwen35moe). 8-битный микромасштабируемый FP практически без...

Генерация текста

ai-sage/GigaChat3.5-432B-A28B-checkpoints

GigaChat 3.5 Ultra — флагманская модель мгновенного обмена сообщениями семейства GigaChat. Это крупномасштабная модель «Смесь экспертов» (MoE) с...

Генерация текста

joelhenwang/OdinNext-138M-Instruct

OdinNext — это причинно-языковая модель со 138 млн параметров, которая заменяет softmax самообслуживание на закрытую линейную рекуррентность в...

Генерация текста

aifeifei798/Mamba3-MIMO-Tiny-HF

!image/png > «Одна из первых HF-совместимых реализаций архитектуры Mamba-3 MIMO». > (全球首批兼容 Обнимающее лицо 的 Мамба-3 MIMO 架构实现之一。)...

Генерация текста

GestaltLabs/BOREAL-10B-MoE

Цель. Гибридная языковая модель Mixture of Experts с ~10 миллиардами параметров и ~2 миллиардами активных параметров на токен....

Генерация текста

guiferrarib/genesis-152m-instruct

🧬 Genesis-152M-Instruct Исследовательская модель малого языка с гибридным линейным вниманием Genesis-152M-Instruct — это экспериментальная модель малого языка, которая...

Генерация текста

NoesisLab/Spartacus-1B-Instruct

Языковая модель с параметрами 1.3B, которая заменяет внимание softmax на причинное моноидное сжатие состояний, обеспечивая время O(1) на...