⚠️ВАЖНО: Данная модель предназначена только для исследовательских целей. Он предоставляется «как есть» без каких-либо гарантий для производственного использования. Ouro-2.6B-Thinking — это специализированный вариант базовой модели Ouro-2.6B, предназначенный для рассуждений, улучшенный за счет контролируемой точной настройки на высококачественных данных рассуждений. Пожалуйста, используйте трансформаторы == 4.54.1 для совместимости. — Расширенное мышление: специально оптимизировано для математических и научных задач. — Компактный размер: конкурентоспособен с моделями 4B, несмотря на наличие всего 2,6B параметров. — Межшаговая согласованность: промежуточные повторяющиеся выходные данные могут служить надежными заменителями окончательных ответов. — Явный процесс мышления: обучен генерировать подробные шаги рассуждения. Вычислительное поведение модели можно настроить через файл config.json: — totalutsteps: контролирует количество повторяющихся шагов (по умолчанию: 4). Вы можете настроить это значение, чтобы найти компромисс между производительностью и временем вычислений. — Earlyexitthreshold: управляет механизмом адаптивного выхода (по умолчанию: 1.0). Более низкие значения способствуют более раннему выходу, а значение 1,0 означает всегда использовать все шаги. > Примечание. vLLM в настоящее время не поддерживает функцию адаптивного выхода из-за ее характеристик оптимизации вывода. При использовании vLLM…
Модальности:
Генерация текста
Области применения:
Логика и рассуждение Диалог / чат
Задача: Генерация текста
Автор: ByteDance
Теги: ouro, looped-language-model, reasoning, recurrent-depth, thinking, chain-of-thought, conversational, custom_code
Лайков: 96 | Загрузок: 16,336
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.