Метка: mixed-precision - Каталог нейросетей

Метка: mixed-precision

Генерация текста

baa-ai/Qwen3.6-27B-RAM-16GB-MLX

Сборка MLX смешанной точности Qwen/Qwen3.6-27B, подготовленная baa.ai. В соответствии с нашей внутренней политикой оценки в обоих режимах декодирования...

Генерация текста

baa-ai/Qwen3.6-35B-A3B-RAM-25GB-MLX

Сборка MLX смешанной точности Qwen/Qwen3.6-35B-A3B, подготовленная baa.ai. Построено в прогнозируемой глобальной (максимальное качество) рабочей точке. Модальности:Генерация текста Области...

Генерация текста

baa-ai/MiniMax-M2.7-RAM-100GB-MLX

Сборка MLX смешанной точности MiniMaxAI/MiniMax-M2.7, подготовленная baa.ai. Настройки для обоих прогонов соответствуют рекомендуемым настройкам вывода ниже. MiniMax-M2.7 использует…...

Генерация текста

mconcat/Qwopus3.5-27B-v3-NVFP4

Квантованная версия Jackrong/Qwopus3.5-27B-v3 смешанной точности (NVFP4/FP8/BF16). Эта контрольная точка сохраняет гибридную архитектуру Qwen3.5 DeltaNet + softmax и головку...

Генерация текста

ShinePixelOrg/Qwopus3.5-27B-v3-NVFP4

Квантованная версия ShinePixelOrg/Qwopus3.5-27B-v3 со смешанной точностью. Эта контрольная точка сохраняет ту же гибридную архитектуру Qwen3.5 DeltaNet + softmax...

Генерация текста

JANGQ-AI/Nemotron-Cascade-2-30B-A3B-JANG_4M

MLX Studio — единственное приложение, которое изначально поддерживает модели JANG с рассуждением Nemotron-Cascade-2-30B-A3B — JANG_4M (4,1-битное, 8-битное внимание)...