avatar

Yuxuan Jiang

江宇轩 First-year PhD Student Tsinghua University jiangyux25@mails.tsinghua.edu.cn

I am Yuxuan Jiang (江宇轩), a first-year PhD student at Tsinghua University. My research focuses on generative models, with a particular emphasis on audio generation and multimodal learning — building controllable, high-fidelity text-to-audio systems.

I am always happy to chat about audio generation, diffusion models, and multimodal learning — feel free to reach out by email.

News

Selected Publications [Google Scholar]

  1. FreeSonic
    Yuxuan Jiang, Mingyang Han, Yusheng Dai, Andong Wang, Tianhong Zhou, Jiaxin Ye, Dongxiao Wang, Haoxiang Shi, Boyu Li, Jun Song, Cheng Yu, Bo Zheng, Weibei Dou, Zehua Chen, Jun Zhu
    Annual Conference of the International Speech Communication Association (INTERSPEECH), 2026.

  2. ControlAudio
    Yuxuan Jiang, Zehua Chen, Zeqian Ju, Yusheng Dai, Weibei Dou, Jun Zhu
    Annual Meeting of the Association for Computational Linguistics (ACL), 2026.

  3. Omni2Sound
    Yusheng Dai, Zehua Chen, Yuxuan Jiang, Hongke Qiu, Jian Fei, Jun Zhu
    IEEE / CVF Computer Vision and Pattern Recognition Conference (CVPR), 2026.

  4. FreeAudio
    Yuxuan Jiang, Zehua Chen, Zeqian Ju, Chang Li, Weibei Dou, Jun Zhu
    ACM International Conference on Multimedia (ACM MM), 2025.

© Yuxuan Jiang, 2026