Qwen/Qwen-Audio-Chat - Каталог нейросетей
Генерация текста

Qwen/Qwen-Audio-Chat

Добавлено:
Qwen/Qwen-Audio-Chat

Квен-Аудио 🤖 | 🤗&nbsp | Qwen-Audio-Chat 🤖 | 🤗&nbsp | &nbsp&nbsp Демо 🤖 | 🤗&nbsp &nbsp&nbspHomepage&nbsp | &nbspPaper Qwen-Audio (Qwen Large Audio Language Model) — это мультимодальная версия большой серии моделей Qwen (сокр. Tongyi Qianwen), предложенной Alibaba Cloud. Qwen-Audio принимает разнообразный звук (человеческую речь, естественный звук, музыку и песни) и текст в качестве входных данных и выводит текст. Вклад Qwen-Audio включает в себя: — Фундаментальные аудиомодели: Qwen-Audio — это фундаментальная многозадачная аудио-языковая модель, которая поддерживает различные задачи, языки и типы аудио и служит универсальной моделью понимания звука. Опираясь на Qwen-Audio, мы разрабатываем Qwen-Audio-Chat посредством тонкой настройки инструкций, обеспечивающей многоповоротные диалоги и поддержку разнообразных аудио-ориентированных сценариев. — Структура многозадачного обучения для всех типов аудио: чтобы расширить предварительное обучение аудиоязыку, мы решаем проблему вариаций в текстовых метках, связанных с различными наборами данных, предлагая структуру многозадачного обучения, позволяющую обмениваться знаниями и избегать помех «один-ко-многим». Наша модель включает в себя более 30 задач, и обширные эксперименты показывают, что модель обеспечивает высокую производительность.…

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Qwen
Теги: qwen, audio-text-to-text, custom_code, zh, en
Лайков: 95  |  Загрузок: 2,551

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.