> Бета-версия — это бета-версия. Ожидается версия 2 с большим количеством обучающих данных и улучшенной методологией обучения. На данный момент эта модель настроена исключительно на отфильтрованном наборе данных nohurry/Opus-4.6-Reasoning-3000x (2326 следов рассуждений из Claude Opus 4.6). Квантование GGUF точно настроенного NVIDIA Nemotron-3-Super-120B-A12B, полученное из следов рассуждений Клода Опуса 4.6. Эта модель была доработана на основе 2326 высококачественных следов рассуждений из Claude Opus 4.6. Модель производит структурированные рассуждения с тегами перед ответом, аналогично моделям o1/стиля рассуждения. Согласно рекомендации NVIDIA, используйте температуру = 1,0 и topp = 0,95` для всех задач — рассуждений, вызова инструментов и общего чата. — BF16 (безопасные тензоры): blobbybob/Nemotron-3-Super-120B-A12B-BF16-Claude-4.6-Opus-Reasoning-Distilled — FP8 (safetensors): blobbybob/Nemotron-3-Super-120B-A12B-FP8-Claude-4.6-Opus-Reasoning-Distilled — Доработано только на 2326 примерах — не может быть обобщено на все области. — Следы рассуждений взяты из Claude Opus 4.6; поведение модели отражает этот стиль. Бета-версия — ожидайте улучшений в версии 2. Эта модель унаследовала лицензию открытой модели NVIDIA Nemotron от базовой модели.
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: blobbybob
Теги: gguf, nemotron, reasoning, distillation, claude, moe, mamba2, fine-tuned
Лайков: 8 | Загрузок: 207
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.