openbmb/MiniCPM4-8B-GGUF - Каталог нейросетей
Генерация текста

openbmb/MiniCPM4-8B-GGUF

Добавлено:
openbmb/MiniCPM4-8B-GGUF

GitHub Repo | Технический отчет 👋 Присоединяйтесь к нам на Discord и WeChat — [2025.06.06] Выпущена серия MiniCPM4! Эта модель обеспечивает максимальное повышение эффективности при сохранении оптимальной производительности в том же масштабе! Он может достигать более чем 5-кратного ускорения поколения на типичных конечных чипах! Вы можете найти технический отчет здесь.🔥🔥🔥 Серия MiniCPM4 — это высокоэффективные большие языковые модели (LLM), разработанные специально для конечных устройств, которые достигают этой эффективности благодаря систематическим инновациям в четырех ключевых измерениях: архитектура модели, обучающие данные, обучающие алгоритмы и системы вывода. — MiniCPM4-8B: флагман MiniCPM4, с параметрами 8B, обученный на токенах 8T. — MiniCPM4-0.5B: Маленькая версия MiniCPM4, с параметрами 0.5B, обученная на токенах 1T. — MiniCPM4-8B-Eagle-FRSpec: Голова орла для FRSpec, ускоряющая спекулятивный вывод для MiniCPM4-8B. — MiniCPM4-8B-Eagle-FRSpec-QAT-cpmcu: голова орла, обученная QAT для FRSpec, эффективно интегрирует спекуляцию и квантование для достижения ультраускорения для MiniCPM4-8B. — MiniCPM4-8B-Eagle-vLLM: голова орла в формате vLLM, ускоряющая спекулятивный вывод для MiniCPM4-8B. — MiniCPM4-8B-marlin-Eagle-vLLM:…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: openbmb
Теги: gguf, zh, en, endpoints_compatible, conversational
Лайков: 4  |  Загрузок: 381

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.