Ling-3.0-flash-GGUF
Кванты включения AI/Ling-3.0-flash, 127,5В-общая/5,1В-активная гибридная МО (bailinghybrid/BailingMoeV3`). Каждый файл здесь содержит только типы тензоров, безопасные для sm120 —...
Кванты включения AI/Ling-3.0-flash, 127,5В-общая/5,1В-активная гибридная МО (bailinghybrid/BailingMoeV3`). Каждый файл здесь содержит только типы тензоров, безопасные для sm120 —...
Официальная сборка OsaurusAI MXFP8 Qwen/Qwen-AgentWorld-35B-A3B (Apache-2.0) — гибридный MoE ~35B / ~3B (qwen35moe). 8-битный микромасштабируемый FP практически без...
GigaChat 3.5 Ultra — флагманская модель мгновенного обмена сообщениями семейства GigaChat. Это крупномасштабная модель «Смесь экспертов» (MoE) с...
OdinNext — это причинно-языковая модель со 138 млн параметров, которая заменяет softmax самообслуживание на закрытую линейную рекуррентность в...
Mamba2-primed-HQwen3-8B-Instruct — это гибридная языковая модель, состоящая из 50 % слоев внимания и 50 % слоев Mamba2, созданных из Qwen3-8B...
!image/png > «Одна из первых HF-совместимых реализаций архитектуры Mamba-3 MIMO». > (全球首批兼容 Обнимающее лицо 的 Мамба-3 MIMO 架构实现之一。)...
Цель. Гибридная языковая модель Mixture of Experts с ~10 миллиардами параметров и ~2 миллиардами активных параметров на токен....
Кими Линейный: выразительная и эффективная архитектура внимания > [!ВАЖНО] > В настоящее время я ищу открытые вакансии! 🤗...
🧬 Genesis-152M-Instruct Исследовательская модель малого языка с гибридным линейным вниманием Genesis-152M-Instruct — это экспериментальная модель малого языка, которая...
Языковая модель с параметрами 1.3B, которая заменяет внимание softmax на причинное моноидное сжатие состояний, обеспечивая время O(1) на...