Llama-3-TKK-8B-Elite-V1.0, генеративная модель, построенная на архитектуре LLaMA 8B, представляет собой мой индивидуальный выпускной проект бакалавриата. Этот проект, разработанный во время моего обучения на факультете разработки программного обеспечения в Университете Малатьи Тургута Озала, стал кульминацией моих академических усилий. Выражаю искреннюю признательность доц. Профессор доктор Харун Бингёль, который одновременно был заведующим моим отделом и руководителем диссертации. Его неоценимое руководство, непоколебимая поддержка и наставничество существенно повлияли на мой образовательный и исследовательский опыт. Я глубоко благодарен ему за постоянную поддержку, проницательные отзывы и непоколебимую преданность делу. Спасибо, доктор Бингёль… Обучение заняло 133 часа 59 минут, всего 37 420 шагов и проводилось на 8 графических процессорах Tesla V100. Базовая модель: LLaMA 8B на основе LLM Разработчики модели: Тарык Каан Коч Руководитель диссертации: доц. Проф. д-р Харун Бингёль Ввод: только текст Вывод: только текст Набор обучающих данных: Очищенные турецкие необработанные данные с 1 миллионом необработанных инструкций Турецкие данные, частный Метод обучения: Точная настройка с помощью LORA loraalpha: 16 loradropout: 0,1 r: 64 смещение: нет Тип задачи: CAUSALLM
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: tarikkaankoc7
Теги: llama, conversational, text-generation-inference, endpoints_compatible
Лайков: 21 | Загрузок: 6
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.