MiMo-V2-Flash-AWQ-4bit
🤗 Обнимающее лицо | 📔 Технический отчет | 📰 Блог | Поиграйтесь! 🗨️ Xiaomi MiMo Studio ...
🤗 Обнимающее лицо | 📔 Технический отчет | 📰 Блог | Поиграйтесь! 🗨️ Xiaomi MiMo Studio ...
GLM-4.5-Air-Derestricted — это версия GLM-4.5-Air с ограниченными ограничениями, созданная Arli AI. Наша цель в этом выпуске — предоставить...
Чтобы обеспечить развертывание Ring-Linear-2.0 на устройствах с ограниченным объемом памяти, мы выпускаем квантованные веса с использованием формата GPTQ...
Попробуйте Laguna XS.2 в Shimmer · Получите ключ API · Выпустите сообщение в блоге Laguna XS.2-INT4 — это...
> [!ВАЖНО] > Уведомление об именовании (10 апреля 2026 г.). Метод «HLWQ», используемый в этой модели, переименовывается в...
Квантованная версия MXFP4 Qwen3.5-122B-A10B (122B параметров, 256 экспертов, гибрид Gated DeltaNet + Gated Attention). Только экспертные веса MLP...
Квантованная NVFP4 версия Stepfun-ai/Step-3.5-Flash, модели рассуждений пограничного уровня с открытым исходным кодом от StepFun с общим количеством 196,81...
Квантованная версия Qwen/Qwen3-Next-80B-A3B-Thinking с использованием LLM Compressor и формата NVFP4 (E2M1 + E4M3). Это должно стать началом новой...
🤗 Обнимающее лицо | 🤖 ModelScope | 🐙 Испытайте сейчас Ling-1T — первая флагманская немыслящая модель в...
Описание: Этот репозиторий содержит модель Qwen 3 235B A22B, квантованную JustinJJA до INT4/W4A16, что значительно уменьшает объем памяти...