Революционная парадигма рассуждения, дополненная шаблонами, позволяет модели 32B превосходить модели o1-mini и дистиллированные модели DeepSeek-R1 в задачах рассуждения. > ReasonFlux-F1-32B — это наш усовершенствованный LLM для рассуждений на уровне SOTA, в котором используются траектории рассуждений, дополненные шаблонами, из нашего ReasonFlux-Zero. Репозиторий Github: Gen-Verse/ReasonFlux Документ:ReasonFlux: Иерархическое рассуждение LLM посредством масштабирования шаблонов мышления * Набор данных: Gen-Verse/ReasonFlux-F1-SFT Мы представляем результаты оценки нашего ReasonFlux-F1-32B для сложных задач рассуждения, включая AIME2024, AIM2025, MATH500 и GPQA-Diamond. Чтобы провести справедливое сравнение, мы сообщаем о результатах LLM в наших оценочных сценариях в ReasonFlux-F1.
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Gen-Verse
Теги: qwen2, llama-factory, full, generated_from_trainer, conversational, text-generation-inference, endpoints_compatible
Лайков: 10 | Загрузок: 7
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.