MiniMax-M2.1-BF16-INT4-AWQ
Это квант высочайшего качества, который может работать на 192 ГБ видеопамяти > [!TIP] > 💡Это родственная модель mratsim/MiniMax-M2.1-FP8-INT4-AWQ...
Это квант высочайшего качества, который может работать на 192 ГБ видеопамяти > [!TIP] > 💡Это родственная модель mratsim/MiniMax-M2.1-FP8-INT4-AWQ...
Квантованная версия MiniMaxAI/MiniMax-M2.1 NVFP4 для эффективного вывода на графических процессорах NVIDIA Blackwell. — Формат: NVFP4 с двухуровневым масштабированием...
MiniMax-M2.7-AWQ-G32-STRIX-2H — это AWQ-квантование смешанной точности amd/MiniMax-M2.7-BF16, созданное для двухузлового вывода AMD Strix Halo (gfx1151) с тензорным параллелизмом...
🚨⚠️ Я ДОСТИГЛ ПРЕДЕЛА БЕСПЛАТНОГО ХРАНЕНИЯ HUGGING FACE ⚠️🚨 Я больше не могу загружать новые модели, если не...
Этот репозиторий квантует модель с помощью инструмента квантования без данных. По состоянию на 16 апреля 2026 г. убедитесь,...
Уничтоженная BF16 контрольно-пропускная точка MiniMax-M2.7, созданная с помощью Heretic ARA. — startlayerindex: 30 — endlayerindex: 51 — savegoodbehaviorweight:...
> Важно: эта модель использует формат квантования JANG — эквивалент GGUF для MLX в Apple Silicon. В настоящее...
> ⚠ Экспериментальная проверка концепции — предупреждение о качестве > > Эта контрольная точка была создана в качестве...
> [!TIP] > Поддержите эту работу → · X · GitHub · Документ REAP · Cerebras REAP 40%...
Квантование смешанной точности с совместной экспертной обрезкой. Подходит для MoE с параметром 228 B в 90 ГБ на...