nvidia/Nemotron-Cascade-8B - Каталог нейросетей
Генерация текста

nvidia/Nemotron-Cascade-8B

Добавлено:
nvidia/Nemotron-Cascade-8B

Мы рады представить Nemotron-Cascade-8B, мощную модель общего назначения, обученную посредством последовательного и предметного обучения с подкреплением. Nemotron-Cascade-8B проходит постобучение на основе модели Qwen3-8B-Base. Он работает как в режиме мышления, так и в режиме инструкции (без рассуждения) и обеспечивает лучшую в своем классе производительность в широком диапазоне тестов. Процесс обучения Nemotron-Cascade начинается с многоэтапного этапа SFT, на котором модель приобретает базовые навыки. Впоследствии Cascade RL применяется в нескольких областях для дальнейшего повышения эффективности модели в этих областях. Примечательно, что RLHF для выравнивания, когда он используется в качестве предварительного шага, повышает способность модели к сложному рассуждению, выходя далеко за пределы простой оптимизации предпочтений, а последующие этапы RLVR по конкретным предметам редко ухудшают производительность тестов, достигнутую в более ранних областях, и могут даже улучшить ее (см. иллюстрацию на следующем рисунке). LiveCodeBench v6 (24.08–25.05) производительность модели Nemotron-Cascade-14B-Thinking на протяжении всего процесса Cascade RL. — Мы сравниваем нашу модель с конкурентными моделями рассуждения по разнообразному набору критериев, включая рассуждения общего характера, согласование и обучение…

Модальности:
Генерация текста

Области применения:
Логика и рассуждение Диалог / чат


Задача: Генерация текста
Автор: nvidia
Теги: qwen3, nvidia, Nemotron-Cascade, reasoning, general-purpose, SFT, RL, conversational
Лайков: 65  |  Загрузок: 33,984

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.