Эта модель основана на ibm-granite/granite-3.3-2b-instruct и предназначена для анализа аргументов, поиска логических ошибок и предоставления предложений по улучшению. Он был предварительно обучен на наборе данных agentlans/reddit-logic, а затем точно настроен с использованием контролируемого обучения на том же наборе данных. Модель выводит объект JSON, содержащий анализ входного аргумента. Пример ожидаемого выходного формата: — Модель имеет те же ограничения, что и датасет agentlans/reddit-logic. — Может не работать также с данными за пределами распределения обучения, включая другие виды общения и области дискурса. — Не имеет специальных знаний, но может предложить ориентиры для продолжения исследований, чтобы критически оценить аргументы. — Может неверно интерпретировать входные данные или создавать искаженные выходные данные, хотя это еще не происходило в тестировании. — Может пропустить некоторые логические ошибки. — Не проверяет ссылки на факты. Следующая установка использовалась как для предварительной подготовки, так и для контролируемой тонкой настройки. Во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-05 — размер серии поездов: 2 — размер серии: 8 — семена: 42 — этапы градиентного накопления: 8 — общий размер серии поездов: 16 -…
Модальности:
Генерация текста
Области применения:
Диалог / чат Следование инструкциям
Задача: Генерация текста
Автор: agentlans
Теги: granite, critical-thinking, analysis, review, argument, conversational, en
Лайков: 4 | Загрузок: 14
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.