nvidia/Nemotron-Cascade-8B-Thinking - Каталог нейросетей
Генерация текста

nvidia/Nemotron-Cascade-8B-Thinking

Добавлено:
nvidia/Nemotron-Cascade-8B-Thinking

Мы рады представить Nemotron-Cascade-8B-Thinking, мощную модель общего назначения, обученную посредством последовательного и предметного обучения с подкреплением. Nemotron-Cascade-8B-Thinking проходит постобучение на модели Qwen3-8B-Base и обеспечивает лучшую в своем классе производительность в широком диапазоне тестов. В отличие от Немотрон-Каскад-8Б, Немотрон-Каскад-8Б-Мышление предназначен исключительно для режима мышления. Процесс обучения Nemotron-Cascade начинается с многоэтапного этапа SFT, на котором модель приобретает базовые навыки. Впоследствии Cascade RL применяется в нескольких областях для дальнейшего повышения эффективности модели в этих областях. Примечательно, что RLHF для выравнивания, когда он используется в качестве предварительного шага, повышает способность модели к сложному рассуждению, выходя далеко за пределы простой оптимизации предпочтений, а последующие этапы RLVR по конкретным предметам редко ухудшают производительность тестов, достигнутую в более ранних областях, и могут даже улучшить ее (см. иллюстрацию на следующем рисунке). LiveCodeBench v6 (24.08–25.05) производительность модели Nemotron-Cascade-14B-Thinking на протяжении всего процесса Cascade RL. — Мы сравниваем нашу модель с моделями конкурентного рассуждения на разнообразном наборе…

Модальности:
Генерация текста

Области применения:
Логика и рассуждение Диалог / чат


Задача: Генерация текста
Автор: nvidia
Теги: qwen3, nvidia, Nemotron-Cascade, reasoning, general-purpose, SFT, RL, conversational
Лайков: 39  |  Загрузок: 1,083

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.