Тайвань LLM — это продвинутая языковая модель, адаптированная для традиционного китайского языка и ориентированная на языковой и культурный контекст Тайваня. Разработанная на основе большой базовой модели, она обогащена разнообразными тайваньскими текстовыми источниками и усовершенствована посредством контролируемой точной настройки. Эта модель превосходно справляется с пониманием и созданием языка и тесно связана с культурными нюансами Тайваня. Он демонстрирует улучшенную производительность по различным тестам, таким как TC-Eval, демонстрируя его контекстуальное понимание и культурную значимость. Подробную информацию о развитии и особенностях Тайваньской LLM можно найти в нашем техническом отчете. – Тип модели: модель, подобная GPT, с параметрами 7B, точно настроенная на основе общедоступных синтетических наборов данных. — Язык(и) (NLP): преимущественно традиционный китайский (zh-tw) — Точная настройка на основе модели: yentinglin/Taiwan-LLM-7B-v2.0-base — Оценка TMMLUS+: 22,19570181818182 — Репозиторий: https://github.com/MiuLab/Taiwan-LLaMa — Демо: https://twllm.com/ Вот как вы можете запустить модель с помощью функции конвейера () из 🤗 Трансформеров: во время обучения использовались следующие гиперпараметры: — скорость обучения: 5e-05 — распределенный тип: несколько графических процессоров — оптимизатор: Адам с бета-версиями = (0,9,0,999) и…
Модальности:
Генерация текста
Области применения:
Диалог / чат
Задача: Генерация текста
Автор: yentinglin
Теги: llama, conversational, zh, text-generation-inference, endpoints_compatible
Лайков: 31 | Загрузок: 47
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.