Эта модель представляет собой доработанную версию BigCode/SantaCoder в сценариях bash/shell The Stack. В наборе оценок он достигает следующих результатов: — Потеря: 1,2272. Модели SantaCoder представляют собой серию моделей с параметрами 1,1 млрд, обученных на подмножестве Python, Java и JavaScript The Stack (v1.1) (без учета запросов на отказ). Основная модель использует внимание к нескольким запросам, была обучена с использованием почти дедупликации и соотношения комментариев к коду в качестве критериев фильтрации и с использованием цели «Заполнить посередине». Кроме того, существует несколько моделей, обученных на наборах данных с различными параметрами фильтров, а также с вариациями архитектуры и целей. Модель была обучена на исходном коде на Python, Java и JavaScript и доработана на скриптах bash/shell. Преобладающим языком источника является английский, хотя присутствуют и другие языки. Таким образом, модель способна генерировать фрагменты кода при условии некоторого контекста, но не гарантируется, что сгенерированный код будет работать должным образом. Он может быть неэффективным, содержать ошибки или эксплойты. Стек содержит более 6 ТБ файлов исходного кода с разрешительной лицензией, охватывающих 358 языков программирования. Набор данных был создан как часть BigCode…
Модальности:
Генерация текста
Области применения:
Генерация кода
Языки программирования:
Bash/Shell
Задача: Генерация текста
Автор: mrm8488
Теги: tensorboard, gpt2, generated_from_trainer, bash, shell, code, codegen, custom_code
Лайков: 5 | Загрузок: 19
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.