Haohan Guo's Page
Haohan Guo's Page
Home
Publications
Experience
Education
CV
Light
Dark
Automatic
Speech Synthesis
Speaking from Coarse to Fine: Improving Neural Codec Language Model via Multi-Scale Speech Coding and Generation
Conference paper accepted by IEEE ICASSP 2025.
Haohan Guo
,
Fenglong Xie
,
Dongchao Yang
,
Xixin Wu
,
Helen Meng
PDF
Cite
Project
FireRedTTS-1S: An Upgraded Streamable Foundation Text-to-Speech System
Preprint: an upgraded streamable foundation TTS system.
Hao-Han Guo
,
Yao Hu
,
Fei-Yu Shen
,
Xu Tang
,
Yi-Chen Wu
,
Feng-Long Xie
,
Kun Xie
PDF
Cite
Code
Project
SoCodec: A Semantic-Ordered Multi-Stream Speech Codec for Efficient Language Model Based Text-to-Speech Synthesis
Conference paper accepted by IEEE SLT 2024.
Haohan Guo
,
Fenglong Xie
,
Kun Xie
,
Dongchao Yang
,
Dake Guo
,
Xixin Wu
,
Helen Meng
PDF
Cite
Code
Project
FireRedTTS: A Foundation Text-To-Speech Framework for Industry-Level Generative Speech Applications
Preprint: an industry-level foundation TTS framework.
Hao-Han Guo
,
Yao Hu
,
Kun Liu
,
Fei-Yu Shen
,
Xu Tang
,
Yi-Chen Wu
,
Feng-Long Xie
,
Kun Xie
,
Kai-Tuo Xu
PDF
Cite
Code
Project
QS-TTS: Towards Semi-Supervised Text-to-Speech Synthesis via Vector-Quantized Self-Supervised Speech Representation Learning
Journal paper accepted by IEEE TASLP (2024).
Haohan Guo
,
Fenglong Xie
,
Jiawen Kang
,
Yujia Xiao
,
Xixin Wu
,
Helen Meng
PDF
Cite
Project
MSMC-TTS: Multi-Stage Multi-Codebook VQ-VAE based Neural TTS
Journal paper accepted by TASLP
Haohan Guo
,
Fenglong Xie
,
Frank K. Soong
,
Xixin Wu
,
Helen Meng
PDF
Cite
Towards High-Quality Neural TTS for Low-Resource Languages by Learning Compact Speech Representations
Submitted to Arxiv
Haohan Guo
,
Fenglong Xie
,
Hui Lu
,
Xixin Wu
,
Helen Meng
PDF
Cite
Code
A Multi-Stage Multi-Codebook VQ-VAE Approach to High-Performance Neural TTS
Conference paper accepted by INTERSPEECH 2022
Haohan Guo
,
Fenglong Xie
,
Frank K. Soong
,
Xixin Wu
,
Helen Meng
PDF
Cite
A Multi-Scale Time-Frequency Spectrogram Discriminator for GAN-based Non-Autoregressive TTS
Conference paper accepted by INTERSPEECH 2022
Haohan Guo
,
Hui Lu
,
Xixin Wu
,
Helen Meng
PDF
Cite
A New GAN-based End-to-End TTS Training Algorithm
Conference paper accepted by INTERSPEECH 2019
Haohan Guo
,
Frank K. Soong
,
Lei He
,
Lei Xie
PDF
Cite
»
Cite
×