Scicom-intl/Multilingual-TTS-1.7B-Base - Каталог нейросетей
Генерация текста

Scicom-intl/Multilingual-TTS-1.7B-Base

Добавлено:
Scicom-intl/Multilingual-TTS-1.7B-Base

Продолжить предварительное обучение Qwen/Qwen3-1.7B-Base по многоязычному преобразованию голоса и TTS. 1. Используйте нейрокодек в качестве детокенизатора речи, 50 TPS, выход с частотой дискретизации 24 тыс. 2. Многоязычное голосовое клонирование с несколькими динамиками, до 35,88 млрд токенов. 3. Многоязычный TTS с несколькими динамиками, более 150 языков, до 25,35 млрд токенов. 4. Flash Внимание 3, мультиупаковка varlen длиной 10 тыс. контекстов. 5. Смешанная точность FP32-BF16. 6. Оптимизатор MuonAdamW. Все шаги для воспроизведения можно найти по адресу https://github.com/Scicom-AI-Enterprise-Organization/Multilingual-TTS/tree/main/vc-evaluation. Вы можете использовать любое имя докладчика, доступное по адресу https://huggingface.co/datasets/malaysia-ai/Multilingual-TTS. Дженни из https://huggingface.co/datasets/reach-vb/jennyttsdataset. Для лучшего параллелизма вы можно использовать https://github.com/Scicom-AI-Enterprise-Organization/TTS-API-Neucodec. Все абляции и шаги по воспроизведению можно найти на https://github.com/Scicom-AI-Enterprise-Organization/Multilingual-TTS.

Модальности:
Генерация текста

Области применения:
Диалог / чат


Задача: Генерация текста
Автор: Scicom-intl
Теги: qwen3, conversational, en, ms, zh, ta, text-generation-inference, endpoints_compatible
Лайков: 5  |  Загрузок: 2,077

Открыть на HuggingFace →

Описание основано на материалах HuggingFace. Перевод выполнен автоматически.