Это практичная модель REAP: высококачественные квантования GGUF для локального вывода без поджога рабочей станции. Построено на основе: — База: MiniMaxAI/MiniMax-M2.5 — Источник REAP: tomngdev/MiniMax-M2.5-REAP-139B-A10B-GGUF (разделение BF16) — Квантовано локально с помощью llama.cpp в Strix Halo + режим большой оперативной памяти. Все кванты представляют собой разделенные наборы GGUF (00001 из 00007 и т. д.) для более безопасной работы с очень большими моделями. — Они генерируются из BF16 REAP GGUF, а не переквантуются с более низкой точностью. — Внедрение токенов и выходные тензоры сохраняются на уровне Q80` во время квантования для сохранения качества. Используйте любой первый сегмент с llama.cpp; он автоматически обнаруживает дочерние фрагменты: — MiniMaxAI для MiniMax-M2.5 — tomngdev для выпуска BF16 REAP GGUF — BennyDaBall для этого пакета квантования. Вы несете ответственность за собственное использование, выходные данные и соблюдение применимых законов и политик платформы.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: BennyDaBall
Теги: gguf, minimax, moe, reap, en, endpoints_compatible, conversational
Лайков: 5 | Загрузок: 163
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.