Метка: hybrid-attention - Каталог нейросетей

Метка: hybrid-attention

Генерация текста

Verdugie/Fable-Therapy-9B

ther·a·py /ˈTHerəpē/ существительное — лечение, направленное на облегчение или излечение расстройства. От греческого therapeía — «исцеление, лечение» —...

Генерация текста

JANGQ-AI/ZAYA1-8B-JANGTQ4

ZAYA не является стандартной архитектурой mlxlm. Он чередует уровни внимания CCA и уровни MoE верхнего уровня 1. Используйте...

Генерация текста

ai-sage/GigaChat3.5-432B-A28B-checkpoints

GigaChat 3.5 Ultra — флагманская модель мгновенного обмена сообщениями семейства GigaChat. Это крупномасштабная модель «Смесь экспертов» (MoE) с...

Генерация текста

Brooooooklyn/Qwen3.6-27B-UD-Q8_K_XL-mlx

8-битное базовое квантование смешанной точности Qwen/Qwen3.6-27B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...

Генерация текста

wangzhang/Qwen3.6-27B-abliterated-GGUF

Квантование GGUF для wangzhang/Qwen3.6-27B-удалено, Qwen3.6-27B с подавлением отказа на втором проходе (10/100 отказов, 15/15 жесткого соответствия, совокупный KL...

Генерация текста

jc-builds/Qwen3.5-9B-Q4_K_M-GGUF

> 4-битный квантованный GGUF Qwen/Qwen3.5-9B, оптимизированный для вывода iOS на устройстве через llama.cpp. Самая мощная модель, которую можно...

Генерация текста

Brooooooklyn/Qwen3.6-27B-UD-Q6_K_XL-mlx

6-битное базовое квантование смешанной точности Qwen/Qwen3.6-27B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Проведено...

Генерация текста

Brooooooklyn/Qwen3.5-9B-unsloth-mlx

3/4/5/6-битное квантование смешанной точности Qwen/Qwen3.5-9B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Декодирование привязано...

Генерация текста

guiferrarib/genesis-152m-instruct

🧬 Genesis-152M-Instruct Исследовательская модель малого языка с гибридным линейным вниманием Genesis-152M-Instruct — это экспериментальная модель малого языка, которая...