hi-paris/ssml-breaks2ssml-fr-lora — это адаптер LoRA, настроенный на Qwen2.5-7B для преобразования текста с символическими маркерами в богатую SSML-разметку с контролем просодии (высота, темп, громкость) и точным временем перерыва. Это второй этап двухэтапного каскадного конвейера SSML для улучшения управления просодией на французском языке. > 📄 Статья: «Улучшение качества синтетической речи с помощью просодического управления SSML» > Авторы: Нассима Ульд-Уали, Авайс Сани, Рубен Буэно, Иона Дауве, Тим Лука Хорстманн, Эрик Мулен > Конференция: ICNLSP 2025 > 🔗 Демонстрационные и аудио-образцы: https://hi-paris.github.io/DemoTTS/ Для производственного использования с оптимизацией памяти см. наш репозиторий выводов: — Базовая модель: Qwen/Qwen2.5-7B — Метод точной настройки: LoRA (низкоранговая адаптация) — Ранг LoRA: 8, альфа: 16 — Целевые модули: qproj, kproj, vproj, oproj,gateproj, upproj, downproj — Обучение: 5 эпох, размер пакета 1 с накоплением градиента — Язык: французский — Размер модели: Параметры 7B (адаптер LoRA: ~81 МБ) — Лицензия**: Apache 2.0. Оценка выполнена на выдержанном французском наборе проверок с аннотированными паузами SSML. Улучшения среднего показателя мнений (MOS), оцененные с использованием результатов TTS с голосом Azure Henri, оценены 30 носителями французского языка…
Модальности:
Генерация текста Синтез речи
Задача: Генерация текста
Автор: hi-paris
Теги: peft, lora, ssml, text-to-speech, qwen2.5, fr
Лайков: 17 | Загрузок: 4
Описание основано на материалах HuggingFace. Перевод выполнен автоматически.