Метка: mixture of experts - Страница 3 - Каталог нейросетей

Метка: mixture of experts

Генерация текста

bullpoint/GLM-4.6-AWQ

Высокопроизводительное AWQ-квантование ZHIPU AI GLM-4.6 (357B MoE), оптимизированное для вывода vLLM. Это профессионально квантованная 4-битная AWQ-версия Z.ai GLM-4.6,...

Генерация текста

bird-of-paradise/deepseek-moe

Чистая и эффективная реализация архитектуры DeepSeek Mixture of Experts (MoE) в PyTorch. Этот репозиторий представляет собой упрощенную версию...

Генерация текста

t-tech/T-Search-FP8

🚨 T-Search-FP8 предназначен для использования с официальной подвеской T-Search. Исходная контрольная точка T-Search не показала заметных отличий относительно...

Генерация текста

hotdogs/Qwen35B-Agent-R2

Построен на базе Qwen/Qwen-AgentWorld-35B-A3B. Идеально настроен для действий. Agent-R2 — это модель слияния нескольких LoRA, построенная на Qwen/Qwen-AgentWorld-35B-A3B,...

Генерация текста

brandonmusic/GLM-5.2-NVFP4-REAP-Recall-N172

Восстановленный из отзыва повторный REAP GLM-5.2-NVFP4 — 172 эксперта на уровень (из 256), самосогласованный, веса BF16 сохранены, эксперты...

Генерация текста

LiquidAI/LFM2.5-8B-A1B-ONNX

LFM2.5-8B-A1B — это модель «Смесь экспертов» с 8 млрд общих параметров и около 1 млрд активных параметров на...

Генерация текста

cyberneurova/cyberneurova-gemma-4-26B-A4B-GGUF

Квантованное GGUF-распределение cyberneurova-gemma-4-26B-A4B — взломанная версия Cyberneurova модели инструкций Gemma-4 26B A4B MoE от CyberNeurova. Часть серии CyberNeurova...

Генерация текста

Youssofal/Qwen3.6-35B-A3B-Abliterated-Heretic-BF16

BF16 уничтожил контрольно-пропускной пункт Qwen3.6-35B-A3B, созданный с помощью Heretic. — базовая модель: Qwen/Qwen3.6-35B-A3B — семейство методов: Еретическая передача...