upaya07/Arithmo2-Mistral-7B - Каталог нейросетей
Генерация текста

upaya07/Arithmo2-Mistral-7B

Добавлено:
upaya07/Arithmo2-Mistral-7B

Модель Arithmo2-Mistral-7B улучшает первоначально выпущенную модель Arithmo-Mistral-7B по тестам GSM8K и MATH. В частности, наблюдается абсолютное улучшение: — +1,7% для GSM8K — +3,0% для GSM8K PoT — +1,9% для MATH Этот репозиторий содержит окончательную объединенную модель. Если вас интересует адаптер LoRA, используйте вместо него адаптер LoRA. — Страница проекта на GitHub: https://github.com/akjindal53244/Arithmo — Разработан: Ашвини Кумар Джиндал — Финансируется: самостоятельная работа — Тип модели: точная настройка с использованием QLoRA на одном графическом процессоре — Язык(и) (NLP): английский — Доработано на основе модели: mistralai/Mistral-7B-v0.1 Arithmo2-Mistral-7B — улучшенная версия Модель Арифмо-Мистраль-7B конкурирует с полностью настроенными современными моделями математического рассуждения 7B. Более подробную информацию можно найти в разделе «Сравнение моделей Arithmo с другими моделями SFT LLM». Оперативный подход GSM8k MATH Zero-Shot CoT 76.4 27.2 Zero-Shot PoT 74.2 — — Zero-Shot CoT: При задании вопроса в качестве подсказки модель генерирует логические шаги для решения вопроса вместе с ответом. Мы проверяем, соответствует ли ответ основной истине. — Zero-Shot PoT: мы предлагаем модели создать программу Python для данного вопроса. Во время вывода мы выполняем Python…

Модальности:
Генерация текста


Задача: Генерация текста
Автор: upaya07
Теги: mistral, Mathematical Reasoning, en, text-generation-inference, endpoints_compatible
Лайков: 8  |  Загрузок: 13

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.