Это модель codellama/CodeLlama-34b-hf, настроенная с использованием QLoRA (4-битная точность) на 13 Б токенах, разработанных csharp. Вопросы и ответы. Мы получили современную производительность в тесте MultiPL-E code LLM для csharp, достигнув 56 % при проходе @1 с n=5. Он был обучен на двух видеокартах NVIDIA A100 PCIe 80 ГБ за 7 часов 40 минут со следующим файлом конфигурации:
Модальности:
Генерация текста
Задача: Генерация текста
Автор: Safurai
Теги: llama, text-generation-inference, endpoints_compatible
Лайков: 4 | Загрузок: 50
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.