— Введение — Результаты тестирования — Наборы обучающих данных — Благодарности Серия Llama-Primus-Nemotron основана на nvidia/Llama-3.1-Nemotron-70B-Instruct посредством непрерывного обучения. Следуя той же методологии, которая описана в статье Primus, мы сначала провели предварительное обучение на крупномасштабных корпусах кибербезопасности (более 10 миллиардов токенов), чтобы получить Llama-Primus-Nemotron-Base. Затем мы провели контролируемую настройку и применили DELLA для слияния с оригинальным Немотроном, в результате чего получился Llama-Primus-Nemotron-70B-Instruct. Llama-Primus-Nemotron-70B-Instruct демонстрирует улучшение совокупных оценок на 18,18% в нескольких общедоступных тестах кибербезопасности, сохраняя при этом ту же производительность в тестах общего назначения (Arena Hard). —————————————|————————————-|—————————————-| CTI-Bench(CVSS) оценивается с использованием среднего абсолютного отклонения (чем ниже, тем лучше), CTI-ATE использует оценку F1, а остальные используют точность. Совокупный балл (Agg.) представляет собой сумму всех тестов с отрицательным значением CTI-Bench(CVSS). — CyberMetric: CyberMetric: эталонный набор данных, основанный на расширенном поиске… — CTI-Bench: CTIBench: A…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: trend-cybertron
Теги: llama, cybersecurity, conversational, en, ja, text-generation-inference, endpoints_compatible
Лайков: 14 | Загрузок: 636
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.