Метка: compressed-tensors - Страница 5 - Каталог нейросетей

Метка: compressed-tensors

Генерация текста

ArliAI/GLM-4.5-Air-Derestricted-FP8

GLM-4.5-Air-Derestricted — это версия GLM-4.5-Air с ограниченными ограничениями, созданная Arli AI. Наша цель в этом выпуске — предоставить...

Генерация текста

inclusionAI/Ring-flash-linear-2.0-GPTQ-int4

Чтобы обеспечить развертывание Ring-Linear-2.0 на устройствах с ограниченным объемом памяти, мы выпускаем квантованные веса с использованием формата GPTQ...

Генерация текста

poolside/Laguna-XS.2-INT4

Попробуйте Laguna XS.2 в Shimmer · Получите ключ API · Выпустите сообщение в блоге Laguna XS.2-INT4 — это...

Генерация текста

caiovicentino1/Qwen3.5-27B-HLWQ-Q5

> [!ВАЖНО] > Уведомление об именовании (10 апреля 2026 г.). Метод «HLWQ», используемый в этой модели, переименовывается в...

Генерация текста

olka-fi/Qwen3.5-122B-A10B-MXFP4

Квантованная версия MXFP4 Qwen3.5-122B-A10B (122B параметров, 256 экспертов, гибрид Gated DeltaNet + Gated Attention). Только экспертные веса MLP...

Генерация текста

tacos4me/Step-3.5-Flash-NVFP4

Квантованная NVFP4 версия Stepfun-ai/Step-3.5-Flash, модели рассуждений пограничного уровня с открытым исходным кодом от StepFun с общим количеством 196,81...

Генерация текста

inclusionAI/Ling-1T-FP8

🤗 Обнимающее лицо   |   🤖 ModelScope    |   🐙 Испытайте сейчас Ling-1T — первая флагманская немыслящая модель в...

Генерация текста

justinjja/Qwen3-235B-A22B-INT4-W4A16

Описание: Этот репозиторий содержит модель Qwen 3 235B A22B, квантованную JustinJJA до INT4/W4A16, что значительно уменьшает объем памяти...