I am Tao Ye (陶也), an M.S. student at the Nanjing University Speech Group (2026–2029), advised by Prof. Shuai Wang. I received my B.Eng. in Artificial Intelligence from Shanghai Jiao Tong University (SJTU), where I was in the AI Talents Pilot Class and the Zhiyuan Honors Program.
Research Interests
- General audio generation
- Audio-visual generation
- Dialogue systems
- Spoken language models
Education
-
Shanghai Jiao Tong University (SJTU)B.Eng. in Artificial Intelligence
AI Talents Pilot Class, Zhiyuan Honors Program, X-LANCE Lab.
Experience
-
Video RebirthResearch Intern
Working on unified audio-visual generation and VTA / V2ST tasks.
-
Shanghai AI Laboratory (Speech Group)Research Intern
Supervised by Prof. Chao Zhang.
Selected Publications
Full list on Publications. Ye Tao is highlighted.
-
First author arXiv 2026Foley-Omni: A Unified Multimodal Generation Model from Task-Level Audio Synthesis to Complete Video Soundtrack Generation
Unified multimodal generation of speech, sound effects, and music for complete video soundtracks.
-
First author ICME 2026MMEdit: A Unified Framework for Multi-Type Audio Editing via Audio Language Model
Unified editing across addition, replacement, removal, reordering, and attribute modification.
-
arXiv 2025UniFlow-Audio: Unified Flow Matching for Audio Generation from Omni-Modalities
Unified flow matching for omni-modal audio generation across aligned and non-aligned tasks.
Contact
- Email ty0402@gmail.com
- GitHub github.com/ty0402
- Scholar Google Scholar
Honors
- Zhiyuan Honors Program, Shanghai Jiao Tong University
- AI Talents Pilot Class, Shanghai Jiao Tong University