Переименовано в parm-2. Обратите внимание: низкие результаты IFEVAL обусловлены тем, что эта модель всегда аргументирует, что следование инструкциям ограничено, что привело к очень низким результатам IFEVAL, это не должно иметь значения для большинства случаев использования. gguf/окончательная версия: https://huggingface.co/Pinkstack/PARM-V2-phi-4-16k-CoT-o1-gguf Технический отчет Phi-4, супермысли 14B, подробные результаты openllm Phi-4, который был настроен для более продвинутого рассуждения. В отличие от других моделей Parm, нам пришлось оптимизировать процесс тонкой настройки, чтобы обеспечить точность, но при этом иметь возможность выпустить эту модель. Потери при обучении: 0,443800 ударов qwen/qwq в MATH, MuSR и GPQA (MuSR является эталоном рассуждения). Оценка: модель может использовать этот формат подсказки: (модифицированная подсказка phi-4, добавив системную подсказку, сообщающую модели рассуждать перед ответом, вы получите аналогичный, если не лучший ответ) Подробные результаты можно найти здесь! Обобщенные результаты можно посмотреть здесь! Согласно https://llm.extractum.io/list/?benchmark=score_elo, эта модель входит в топ-20 в таблице лидеров LMSys ELO. (q4km, 10 ГБ rtx 3080, 64 ГБ памяти, работает внутри MSTY, все используют «Вы дружелюбный помощник искусственного интеллекта».) в качестве подсказки системы.) Пример 1: !example1…
Модальности:
Генерация текста
Области применения:
Генерация кода Математика Логика и рассуждение Диалог / чат Мультиязычность
Задача: Генерация текста
Автор: Pinkstack
Теги: llama, phi, nlp, math, code, chat, conversational, phi3
Лайков: 7 | Загрузок: 38
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.