Метка: quantized - Страница 22 - Каталог нейросетей

Метка: quantized

Генерация текста

mlx-community/Laguna-S-2.1-oQ3e-fast

Вариант Laguna-S-2.1-oQ3e с настроенной скоростью, калиброванное 3-битное квантование MLX у бассейна/Laguna-S-2.1 (всего 118B, 8B активируется на каждый токен)....

Генерация текста

0ppxnhximxr/Motif-3-Beta-FP8

> Внимание: восходящий путь вывода HF нарушен (подтверждено поставщиком > 22 июля 2026 г.: «HF.generate в настоящее время...

Генерация текста

AtomicChat/Hy3-GGUF

Hy3, самоквантованный до GGUF с помощью Atomic Chat. Создано прямо на основе исходных весов Tencent с матрицей важности...

Генерация текста

olka-fi/Hy3-MXFP4

> 4-битное квантование MXFP4 tencent/Hy3. > Оригинальная карта модели полностью сохранена ниже. Квант MXFP4 только по весу, создаваемый...

Генерация текста

olka-fi/Ornith-1.0-397B-MXFP4

4-битное квантование MXFP4 Ornith-1.0-397B, созданное с помощью qstream. Только перенаправленные эксперты MoE (~95% весов) квантуются в MXFP4; все,...

Генерация текста

Jiunsong/SuperQwen-AgentWorld-35B-A3B-abliterated-nvf4

Этот репозиторий содержит 4-битную квантованную сборку Jiunsong/SuperQwen-AgentWorld-35B-A3B, удаленную. Номера тестов и подробности проверки см. в родительском репозитории BF16....