Code-Llama-3-8B
Эта модель обучена на усовершенствованной версии моего набора данных Code-290k-ShareGPT. Идея заключалась в том, чтобы проверить, как эта...
Эта модель обучена на усовершенствованной версии моего набора данных Code-290k-ShareGPT. Идея заключалась в том, чтобы проверить, как эта...
Модель Transformer, предназначенная только для декодера параметров 1B, обученная на коде с использованием цели с причинно-следственной маской, которая...
Мы использовали кросс-энтропию softmax и модифицированную форму политики градиента вместе с потерей Q, оптимизированную в настройке EM. Производительность...
Модель Transformer, предназначенная только для декодера параметров 6B, обученная на коде с использованием цели с причинно-следственной маской, которая...
Maincoder-1B — это языковая модель, ориентированная на код, оптимизированная для задач генерации и завершения кода. Модель обеспечивает высокую...