Publications
2026
- Do Emotion Concepts Generalize Across Sources, Modalities, and Architectures in Vision-Language Models?arXiv preprint, 2026
- Diving-R1: Empowering Multimodal LLMs with Traceable Progressive Reasoning for Interpretable Diving Action Quality AssessmentAdvances in Neural Information Processing Systems (NeurIPS), 2026
- Insights from Visual Cognition: Understanding Human Action Dynamics with Overall Glance and Refined Gaze TransformerKnowledge-Based Systems, 2026
- MSF-Mamba: Motion-aware State Fusion Mamba for Efficient Micro-Gesture RecognitionIEEE Transactions on Multimedia, 2026
- Identity-Free Artificial Emotional Intelligence via Micro-Gesture UnderstandingIEEE Transactions on Affective Computing, 2026
- Multi-granularity Facial Emotional Representation with Unlabeled Data and Textual SupervisionIEEE Transactions on Image Processing, 2026
- EmotionHallucer: Evaluating Emotion Hallucinations in Multimodal Large Language ModelsInternational Conference on Learning Representations (ICLR), 2026
- EMO-LLaMA: Enhancing Facial Emotion Understanding with Instruction TuningInternational Journal of Computer Vision, 2026
- MGMILA: Eulerian Motion-aware MILA for Micro-gesture RecognitionMachine Intelligence Research, 2026
2025
- AU-TTT: Vision Test-Time Training model for Facial Action Unit DetectionIEEE International Conference on Multimedia and Expo (ICME), 2025
- FSBench: A Figure Skating Benchmark for Advancing Artistic Sports UnderstandingIEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025
- DEEMO: De-identity Multimodal Emotion Recognition and ReasoningACM International Conference on Multimedia (ACM MM), 2025
2024
- Enhancing Micro Gesture Recognition for Emotion Understanding via Context-Aware Visual-Text Contrastive LearningIEEE Signal Processing Letters, 2024
- Eald-mllm: Emotion analysis in long-sequential and de-identity videos with multi-modal large language modelarXiv preprint, 2024
- scFusionTTT: Single-cell transcriptomics and proteomics fusion with Test-Time Training layersarXiv preprint, 2024