Эта модель представляет собой доработанную версию LLaMa-3-Instruct-8B. Он был представлен в RATIONALYST: Контроль над процессом предварительного обучения для улучшения мышления. Код для извлечения обоснования, обучения модели и вывода можно найти здесь. Неявные обоснования часто встроены в неразмеченный текст, отражая естественные мыслительные процессы, лежащие в основе речи и письма. RATIONALYST — это самоконтролируемый подход для извлечения и фильтрации этих неявных обоснований из неразмеченного текста и применения их для контроля рассуждений. Чтобы использовать его, просто введите вопрос и частичную траекторию рассуждения, и модель выведет обоснование для контроля следующего шага рассуждения. Этот рационалист обучен с использованием 65 тысяч неявных обоснований из The Pile и 14 тысяч неявных обоснований из GSM8K и ECQA. Используемые данные можно найти здесь. При использовании для оценки последующих задач эта модель дает следующие результаты:
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: Dongwei
Теги: llama, feature-extraction, conversational, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 136
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.