Metadata-Enhanced Speech Emotion Recognition: Augmented Residual Integration and Co-Attention in Two-Stage Fine-Tuning
Published in ICASSP 2025
Zixiang Wan*, Ziyue Qiu*, Yiyang Liu, Wei-Qiang Zhang†
Recommended citation: Zixiang Wan, Ziyue Qiu, Yiyang Liu, and Wei-Qiang Zhang. "Metadata-Enhanced Speech Emotion Recognition: Augmented Residual Integration and Co-Attention in Two-Stage Fine-Tuning." IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 2025.
Download Paper
