baa-ai/MiniMax-M2.7-RAM-100GB-MLX - Каталог нейросетей
Генерация текста

baa-ai/MiniMax-M2.7-RAM-100GB-MLX

Добавлено:
baa-ai/MiniMax-M2.7-RAM-100GB-MLX

Сборка MLX смешанной точности MiniMaxAI/MiniMax-M2.7, подготовленная baa.ai. Настройки для обоих прогонов соответствуют рекомендуемым настройкам вывода ниже. MiniMax-M2.7 использует… блок рассуждений. Важно: базовый шаблон чата вставляет n в конец приглашения перед генерацией, поэтому вывод модели начинается внутри блока рассуждений без открывающего тега. Удалите все до первого: дайте модели достаточный бюджет токенов, чтобы она могла завершить рассуждения и выдать закрывающий тег — мы рекомендуем как минимум 4096 и 8192 для более сложных задач. — Для удобства вывода рекомендуется Apple Silicon Mac с унифицированной памятью ~112 ГБ. — При обмене работает меньше, при существенно сниженной пропускной способности. Shepherd — частная платформа для развертывания искусственного интеллекта, которая сокращает передовые модели на 50–60 % за счет сжатия оперативной памяти, позволяя предприятиям запускать сложный искусственный интеллект на отдельных экземплярах графического процессора или оборудовании Apple Silicon. Выполните развертывание в своем VPC, не покидая инфраструктуру. Включает интеграцию конвейера CI/CD, развертывание парка в кластерах Apple Silicon, поддержку изолированного и независимого развертывания, а также многоформатный экспорт (MLX, GGUF). Годовая стоимость облака составляет от ~ 2700 долларов США — или запуск на Mac Studio за…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: baa-ai
Теги: mlx, minimax_m2, quantized, mixed-precision, minimax, moe, conversational, custom_code
Лайков: 5  |  Загрузок: 177

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.