Метка: mixture of experts - Страница 2 - Каталог нейросетей

Метка: mixture of experts

Генерация текста

JANGQ-AI/ZAYA1-8B-JANGTQ4

ZAYA не является стандартной архитектурой mlxlm. Он чередует уровни внимания CCA и уровни MoE верхнего уровня 1. Используйте...

Генерация текста

allenai/StdMoE_1b14b_1T_EmoAnnealed

Контрольная точка абляции выпущена вместе с EMO: Предварительная подготовка экспертов для новой модульности, называемая EMO-отжигом в Приложении B.4...

Генерация текста

allenai/StdMoE_1b14b_1T_Preanneal

Контрольная точка предварительного отжига стандартной базовой линии MoE, выпущенная вместе с EMO: Pretraining Mixture of Experts for Emergent...

Генерация текста

allenai/StdMoE_1b4b_130B

Стандартный базовый уровень MoE, соответствующий памяти, выпущенный вместе с EMO: Pretraining Mixture of Experts for Emergent Modularity, называемый...

Генерация текста

allenai/BAR-5x7B

BAR (Branch-Adapt-Route) — это модульный подход после обучения, который расширяет полностью обученную языковую модель новыми возможностями предметной области...

Генерация текста

mlx-community/Qwen3.5-397B-A17B-nvfp4

4-битная квантованная версия текстовой модели nvfp4 MLX из Qwen/Qwen3.5-397B-A17B. Части этой карты были скопированы или адаптированы из оригинальной...

Генерация текста

LiquidAI/LFM2-8B-A1B-ONNX

LFM2-MoE — это модель «Смесь экспертов» с общим количеством параметров 8 млрд и активными параметрами ~ 1 млрд...

Генерация текста

Kirim-ai/Kirim-V2

Модель генерации текста Модальности:Генерация текста Области применения:Логика и рассуждение Диалог / чат Вызов функций (Tool use) Мультиязычность Задача:...