Обладая обширной подготовкой с помощью обучения с подкреплением в сотнях тысяч сложных реальных сред, M2.5 является SOTA в программировании, использовании и поиске агентских инструментов, офисной работе и ряде других экономически ценных задач, имея оценки 80,2% в SWE-Bench Verified, 51,3% в Multi-SWE-Bench и 76,3% в BrowseComp (с контекстным управлением). Обученный эффективно рассуждать и оптимально разлагать задачи, M2.5 демонстрирует огромную скорость при выполнении сложных агентских задач, выполняя оценку SWE-Bench Verified на 37% быстрее, чем M2.1, что соответствует скорости Claude Opus 4.6. M2.5 — это первая передовая модель, в которой пользователям не нужно беспокоиться о стоимости, поскольку она обещает интеллектуальные возможности, слишком дешевые для измерения. Непрерывная работа модели в течение часа со скоростью 100 токенов в секунду стоит всего 1 доллар. При скорости 50 токенов в секунду стоимость снижается до 0,30 доллара. Мы надеемся, что скорость и экономическая эффективность M2.5 позволят создать новые инновационные агентные приложения. В ходе программных оценок MiniMax-M2.5 продемонстрировал существенные улучшения по сравнению с предыдущими поколениями, достигнув уровня SOTA. Особенно выражена производительность M2.5 в многоязычных задачах. Значительное улучшение…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: cyankiwi
Теги: minimax_m2, conversational, custom_code, endpoints_compatible, compressed-tensors
Лайков: 11 | Загрузок: 5,431
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.