trend-cybertron/Llama-Primus-Nemotron-70B-Instruct - Каталог нейросетей
Генерация текста

trend-cybertron/Llama-Primus-Nemotron-70B-Instruct

Добавлено:
trend-cybertron/Llama-Primus-Nemotron-70B-Instruct

— Введение — Результаты тестирования — Наборы обучающих данных — Благодарности Серия Llama-Primus-Nemotron основана на nvidia/Llama-3.1-Nemotron-70B-Instruct посредством непрерывного обучения. Следуя той же методологии, которая описана в статье Primus, мы сначала провели предварительное обучение на крупномасштабных корпусах кибербезопасности (более 10 миллиардов токенов), чтобы получить Llama-Primus-Nemotron-Base. Затем мы провели контролируемую настройку и применили DELLA для слияния с оригинальным Немотроном, в результате чего получился Llama-Primus-Nemotron-70B-Instruct. Llama-Primus-Nemotron-70B-Instruct демонстрирует улучшение совокупных оценок на 18,18% в нескольких общедоступных тестах кибербезопасности, сохраняя при этом ту же производительность в тестах общего назначения (Arena Hard). —————————————|————————————-|—————————————-| CTI-Bench(CVSS) оценивается с использованием среднего абсолютного отклонения (чем ниже, тем лучше), CTI-ATE использует оценку F1, а остальные используют точность. Совокупный балл (Agg.) представляет собой сумму всех тестов с отрицательным значением CTI-Bench(CVSS). — CyberMetric: CyberMetric: эталонный набор данных, основанный на расширенном поиске… — CTI-Bench: CTIBench: A…

Модальности:
Генерация текста

Области применения:
Диалог / чат Следование инструкциям


Задача: Генерация текста
Автор: trend-cybertron
Теги: llama, cybersecurity, conversational, en, ja, text-generation-inference, endpoints_compatible
Лайков: 14  |  Загрузок: 636

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.