Метка: oQ - Каталог нейросетей

Метка: oQ

Генерация текста

mlx-community/Laguna-S-2.1-oQ3e-fast

Вариант Laguna-S-2.1-oQ3e с настроенной скоростью, калиброванное 3-битное квантование MLX у бассейна/Laguna-S-2.1 (всего 118B, 8B активируется на каждый токен)....

Генерация текста

bearzi/Qwen3.6-35B-A3B-oQ8

— Квантование: oQ8 (смешанная точность, управляемая чувствительностью, размер группы = 64) — Формат: MLX Safetensors — Совместимость с:**...

Генерация текста

bearzi/Qwen3.6-35B-A3B-oQ4

— Квантование: oQ4 (смешанная точность, управляемая чувствительностью, размер группы = 64) — Формат: MLXsafetensors — Совместимость с:** mlx-lm,...

Генерация текста

mlx-community/Hy3-oQ2

Калиброванное 2-битное квантование MLX tencent/Hy3 (Hunyuan 3.0, 295B-A21B MoE), созданное с помощью omlx oQ на уровне 2 —...

Генерация текста

mlx-community/Qwen-AgentWorld-35B-A3B-oQ4

oQ4 (смешанная точность на основе данных, ≈4,6 бит в секунду) MLX-квантование Qwen/Qwen-AgentWorld-35B-A3B, созданное с помощью quantizeoqstreaming oMLX. Для...