Метка: hybrid-attention - Страница 2 - Каталог нейросетей

Метка: hybrid-attention

Генерация текста

Brooooooklyn/Qwen3.5-9B-unsloth-mlx

3/4/5/6-битное квантование смешанной точности Qwen/Qwen3.5-9B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Декодирование привязано...

Генерация текста

guiferrarib/genesis-152m-instruct

🧬 Genesis-152M-Instruct Исследовательская модель малого языка с гибридным линейным вниманием Genesis-152M-Instruct — это экспериментальная модель малого языка, которая...

Генерация текста

Brooooooklyn/Qwen3.5-27B-unsloth-mlx

3/4/5/6-битное квантование смешанной точности Qwen/Qwen3.5-27B для Apple Silicon с использованием стратегии квантования Unsloth Dynamic через mlx-node. Декодирование привязано...