Репозиторий GitHub | Технический отчет | Присоединяйтесь к нам 👋 Свяжитесь с нами в Discord и WeChat — [2025.09.29] Выпущена статья InfLLM-V2! Мы можем обучить модель разреженного внимания, используя всего 5 миллиардов токенов длинного текста. 🔥🔥🔥 — [2025.09.05] Выпущена серия MiniCPM4.1! Эта серия представляет собой гибридную модель рассуждения с обучаемым редким вниманием, которую можно использовать как в режиме глубокого рассуждения, так и в режиме без рассуждения. 🔥🔥🔥 — [2025.06.06] Вышла серия MiniCPM4! Эта модель обеспечивает максимальное повышение эффективности при сохранении оптимальной производительности в том же масштабе! Он может обеспечить более чем пятикратное ускорение генерации на типичных микросхемах конечной стороны! Технический отчет можно найти здесь.🔥🔥🔥 ✅ Сильная аргументация: превосходит модели аналогичного размера в 15 задачах! ✅ Эффективная архитектура: обучаемое разреженное внимание, спекулятивное декодирование с частотным ранжированием! — MiniCPM4.1-8B: последняя версия MiniCPM4 с параметрами 8B поддерживает объединенное мышление. ( — MiniCPM4-8B: флагманская модель с 8B параметрами, обученная на токенах 8T — MiniCPM4-0.5B: облегченная версия с параметрами 0,5B, обученная на токенах 1T — MiniCPM4-8B-Eagle-FRSpec: Eagle head для FRSpec, ускоряющая спекулятивный вывод — MiniCPM4-8B-Eagle-FRSpec-QAT-cpmcu:…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: openbmb
Теги: minicpm, conversational, custom_code, zh, en
Лайков: 384 | Загрузок: 36,050
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.