ServiceNow-AI/Apriel-Nemotron-15b-Thinker - Каталог нейросетей
Генерация текста

ServiceNow-AI/Apriel-Nemotron-15b-Thinker

Добавлено:
ServiceNow-AI/Apriel-Nemotron-15b-Thinker

Apriel-Nemotron-15b-Thinker — это модель рассуждения с 15 миллиардами параметров из серии Apriel SLM от ServiceNow, которая обеспечивает конкурентоспособную производительность по сравнению с современными моделями аналогичного размера, такими как o1-mini, QWQ-32b и EXAONE-Deep-32b, сохраняя при этом лишь половину занимаемой памяти по сравнению с этими альтернативами. Он основан на контрольно-пропускном пункте на базе «Апрель-15b» и проходит трехэтапную программу обучения (CPT, SFT и GRPO). Особенности — Размер вдвое меньше, чем у моделей SOTA, таких как QWQ-32b и EXAONE-32b, и, следовательно, более эффективное использование памяти. — Он потребляет на 40% меньше токенов по сравнению с QWQ-32b, что делает его очень эффективным в производстве. 🚀🚀🚀 — На одном уровне или превосходит такие задачи, как MBPP, BFCL, Enterprise RAG, MT Bench, MixEval, IFEval и Multi-Challenge, что делает его идеальным для агентских/корпоративных задач. — Конкурентоспособная производительность по академическим тестам, таким как AIME-24, AIME-25, AMC-23, MATH-500 и GPQA, с учетом размера модели. Промежуточное обучение/постоянное предварительное обучение. На этом этапе модель обучается на более чем 100 миллиардах токенов тщательно подобранных примеров, взятых из математических рассуждений, задач кодирования, научных дискуссий и логических головоломок. Цель состоит в том, чтобы усилить фундаментальные способности модели к рассуждению.…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: ServiceNow-AI
Теги: mistral, conversational, text-generation-inference, endpoints_compatible
Лайков: 125  |  Загрузок: 59

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.