Жангир Азербаев, Хейли Шёлкопф, Кейран Пастер, Марко Дос Сантос, Стивен Макалир, Альберт К. Цзян, Цзя Дэн, Стелла Бидерман, Шон Веллек Лемма 7B — это языковая модель для математики. Он был инициализирован с весами Code Llama 7B и обучен на Proof-Pile-2 для 200B токенов. Эта модель также поставляется в версии с параметрами 34B: Лемма 34B. Модели лемм особенно сильны в математических рассуждениях и использовании вычислительных инструментов для математики, таких как Python и формальные средства доказательства теорем. В математических задачах, связанных с цепочкой мыслей, модели Llemma превосходят Llama-2, Code Llama, а с учетом размера модели превосходят Minerva. Дополнительную производительность можно получить, используя голосование большинством: в дополнение к цепочке мыслей Llemma обладает сильными возможностями в решении задач вычислительной математики. Информацию об использовании инструментов и формальных оценках доказательства теорем см. в нашей статье.
Модальности:
Генерация текста
Области применения:
Математика Логика и рассуждение
Задача: Генерация текста
Автор: EleutherAI
Теги: llama, math, reasoning, en, text-generation-inference, endpoints_compatible
Лайков: 112 | Загрузок: 631
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.