avatar

Yuxuan Jiang

江宇轩 PhD Student Tsinghua University jiangyux25@mails.tsinghua.edu.cn

I am Yuxuan Jiang (江宇轩), a PhD student at Tsinghua University. My research interests include multimodal learning, diffusion models, and audio generation.
I study unified representations for speech, environmental sounds, and music that capture acoustic details, semantic content, and temporal structure. I also explore cross-modal and interaction-driven models that predict how sound evolves, enabling continuous and controllable audio generation grounded in physical and structural priors.

I welcome conversations and collaborations on these and related topics, from informal exchanges to in-depth discussions. Please feel free to reach out by email.

News

Selected Publications [Google Scholar]

  1. CineDub
    Yusheng Dai, Kangdi Wang, Baolong Gao, Yuxuan Jiang, Weiqiang Wang, Qiuhong Ke, Jianfei Cai
    ACM International Conference on Multimedia (ACM MM), 2026.

  2. Vidu S1
    Jintao Zhang, Kai Jiang, Jintao Chen, Xu Wang, Yang Luo, Yuji Wang, Dechuang Chen, Jungang Li, Chengyang Ye, Marco Chen, Hongzhou Zhu, Min Zhao, Yuxuan Jiang, Zhengkun Huang, Chendong Xiang, Kaiwen Zheng, Haoxu Wang, Xiaohang Wang, Qi Jia, Xin Chen, Yimin Chen, Youhe Jiang, Fangcheng Fu, Zhijie Deng, Fan Bao, Jianfei Chen, Jun Zhu
    Technical Report, 2026.

  3. SR-Edit
    Andong Wang, Zehua Chen, Yuxuan Jiang, Jun Zhu
    European Conference on Computer Vision (ECCV), 2026.

  4. FreeSonic
    Yuxuan Jiang, Mingyang Han, Yusheng Dai, Andong Wang, Tianhong Zhou, Jiaxin Ye, Dongxiao Wang, Haoxiang Shi, Boyu Li, Jun Song, Cheng Yu, Bo Zheng, Weibei Dou, Zehua Chen, Jun Zhu
    Annual Conference of the International Speech Communication Association (INTERSPEECH), 2026.

  5. ControlAudio
    Yuxuan Jiang, Zehua Chen, Zeqian Ju, Yusheng Dai, Weibei Dou, Jun Zhu
    Annual Meeting of the Association for Computational Linguistics (ACL), 2026.

  6. Omni2Sound
    Yusheng Dai, Zehua Chen, Yuxuan Jiang, Hongke Qiu, Jian Fei, Jun Zhu
    IEEE / CVF Computer Vision and Pattern Recognition Conference (CVPR), 2026.

  7. FreeAudio
    Yuxuan Jiang, Zehua Chen, Zeqian Ju, Chang Li, Weibei Dou, Jun Zhu
    ACM International Conference on Multimedia (ACM MM), 2025.

© Yuxuan Jiang, 2026