>TL;DR: Llama-Primus-Reasoning — это модель рассуждения, основанная на этапах рассуждения с данными отражения, сгенерированными o1-preview и DeepSeek-R1 для задач кибербезопасности (Primus-Reasoning), на основе Llama-Primus-Merged. Он демонстрирует улучшение сертификации безопасности (CISSP) на 🚀15,8%. 🔥 Более подробную информацию можно найти в статье: [[📄Paper]](https://arxiv.org/abs/2502.11191). 📢 Новости (02.06.2025): Мы расширили набор данных Primus-Reasoning дополнительными образцами из DeepSeek-R1. Соответственно, мы заменили Llama-Primus-Reasoning новой версией, полученной совместно из DeepSeek-R1 и o1-preview. Эта версия обеспечивает лучшую производительность CISSP с улучшением на 15,8%. В последние годы модели большого языка (LLM) продемонстрировали замечательную универсальность и нашли многообещающее применение в специализированных областях, таких как финансы, право и биомедицина. Однако в сфере кибербезопасности мы заметили отсутствие наборов данных с открытым исходным кодом, специально предназначенных для предварительного обучения LLM, хотя многие исследования показали, что LLM приобретают свои знания во время предварительного обучения. Чтобы восполнить этот пробел, мы представляем коллекцию наборов данных, охватывающих несколько этапов обучения LLM в области кибербезопасности,…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: trendmicro-ailab
Теги: llama, cybersecurity, pretraining, conversational, en, text-generation-inference, endpoints_compatible
Лайков: 17 | Загрузок: 716
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.