unsloth/Phi-4-reasoning-plus - Каталог нейросетей
Генерация текста

unsloth/Phi-4-reasoning-plus

Добавлено:
unsloth/Phi-4-reasoning-plus

Наши обучающие данные представляют собой смесь вопросов и ответов, данных формата чата по математике, естественным наукам и программированию. Подсказки чата получаются из отфильтрованных высококачественных веб-данных и при необходимости перезаписываются и обрабатываются с помощью конвейера генерации синтетических данных. Мы также включаем данные для повышения правдивости и безопасности. Мы оценили Phi-4-reasoning-plus, используя пакет оценки Eureka с открытым исходным кодом и наши собственные внутренние тесты, чтобы понять возможности модели. В частности, мы оцениваем нашу модель на: OmniMath:** Коллекция из более чем 4000 математических задач олимпиадного уровня с человеческими аннотациями. LiveCodeBench:** тест генерации кода, полученный в ходе конкурентных соревнований по программированию. 3SAT (3-литеральная проблема выполнимости) и TSP (задача коммивояжера):** Алгоритмическое решение задач. MMLU-Pro:** Популярный агрегированный набор данных для многозадачного понимания языка. Phi-4-reasoning-plus использует надежный посттренировочный подход к обеспечению безопасности посредством контролируемой точной настройки (SFT). В этом подходе используются различные синтетические подсказки, созданные как с открытым исходным кодом, так и собственными силами, а также ответы, генерируемые LLM, которые соответствуют строгим правилам безопасности Microsoft, например, «Понимание и ясность пользователей», «Безопасность и этика…».

Модальности:
Генерация текста

Области применения:
Генерация кода Математика Логика и рассуждение Диалог / чат


Задача: Генерация текста
Автор: unsloth
Теги: phi3, phi, unsloth, nlp, math, code, chat, conversational
Лайков: 7  |  Загрузок: 26

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.