Author Resource

Citation Reference Library

A curated BibTeX reference page for NeuroMM 2026 workshop authors. Search by topic, venue, author, or citation key, then copy the BibTeX block directly into your manuscript.

37 References
9 Topic Groups
BibTeX Ready to Copy
No matching references found. Try another keyword or choose a different topic group.

Epileptic Discharge Detection

Core references for IED detection, localization, vEpiSet, and the NeuroMM challenge.

3 references

An EEG dataset for interictal epileptiform discharge with spatial distribution information

Scientific Data 2025 Dataset

Lin, Nan; Zheng, Mengxuan; Li, Lian; Hu, Peng; Gao, Weifang; Sun, Heyang; Xu, Chang; Yuan, Gonglin; Liang, Zi; Dong, Yisu; and others.

@article{lin2025eeg}
@article{lin2025eeg,
  title={An EEG dataset for interictal epileptiform discharge with spatial distribution information},
  author={Lin, Nan and Zheng, Mengxuan and Li, Lian and Hu, Peng and Gao, Weifang and Sun, Heyang and Xu, Chang and Yuan, Gonglin and Liang, Zi and Dong, Yisu and others},
  journal={Scientific Data},
  volume={12},
  number={1},
  pages={229},
  year={2025},
  publisher={Nature Publishing Group UK London}
}

NeuroMM 2026: Interictal Epileptiform Discharge Detection and Localization in Multimodal Neuro-Signals

NeuroMM 2026 Challenge Multimodal Neuro-Signals

Tian, Qi; Ma, Fei; He, Haibo; Cui, Laizhong; Lin, Nan; Lian, Zheng; Fournier-Viger, Philippe; Cheng, Zebang; and others.

@article{tianneuromm}
@article{tianneuromm,
  title={NeuroMM 2026: Interictal Epileptiform Discharge Detection and Localization in Multimodal Neuro-Signals},
  author={Tian, Qi and Ma, Fei and He, Haibo and Cui, Laizhong and Lin, Nan and Lian, Zheng and Fournier-Viger, Philippe and Cheng, Zebang and others}
}

vEpiNet: A multimodal interictal epileptiform discharge detection method based on video and electroencephalogram data

Neural Networks 2024 Video + EEG

Lin, Nan; Gao, Weifang; Li, Lian; Chen, Junhui; Liang, Zi; Yuan, Gonglin; Sun, Heyang; Liu, Qing; Chen, Jianhua; Jin, Liri; and others.

@article{lin2024vepinet}
@article{lin2024vepinet,
  title={vEpiNet: A multimodal interictal epileptiform discharge detection method based on video and electroencephalogram data},
  author={Lin, Nan and Gao, Weifang and Li, Lian and Chen, Junhui and Liang, Zi and Yuan, Gonglin and Sun, Heyang and Liu, Qing and Chen, Jianhua and Jin, Liri and others},
  journal={Neural Networks},
  volume={175},
  pages={106319},
  year={2024},
  publisher={Elsevier}
}

Emotion Large Multimodal Models

References for multimodal emotion reasoning, affective instruction tuning, and emotional voice conversion.

4 references

Emotion-llama: Multimodal emotion recognition and reasoning with instruction tuning

NeurIPS 2024 Instruction Tuning

Cheng, Zebang; Cheng, Zhi-Qi; He, Jun-Yan; Sun, Jingdong; Wang, Kai; Lin, Yuxiang; Lian, Zheng; Peng, Xiaojiang; Hauptmann, Alexander G.

@article{cheng2024emotion}
@article{cheng2024emotion,
  title={Emotion-llama: Multimodal emotion recognition and reasoning with instruction tuning},
  author={Cheng, Zebang and Cheng, Zhi-Qi and He, Jun-Yan and Sun, Jingdong and Wang, Kai and Lin, Yuxiang and Lian, Zheng and Peng, Xiaojiang and Hauptmann, Alexander G},
  journal={Advances in Neural Information Processing Systems},
  volume={37},
  pages={110805--110853},
  year={2024}
}

AffectGPT: A New Dataset, Model, and Benchmark for Emotion Understanding with Multimodal Large Language Models

ICML 2025 Benchmark

Lian, Zheng; Chen, Haoyu; Chen, Lan; Sun, Haiyang; Sun, Licai; Ren, Yong; Cheng, Zebang; Liu, Bin; Liu, Rui; Peng, Xiaojiang; and others.

@inproceedings{lian2025affectgpt}
@inproceedings{lian2025affectgpt,
  title={AffectGPT: A New Dataset, Model, and Benchmark for Emotion Understanding with Multimodal Large Language Models},
  author={Lian, Zheng and Chen, Haoyu and Chen, Lan and Sun, Haiyang and Sun, Licai and Ren, Yong and Cheng, Zebang and Liu, Bin and Liu, Rui and Peng, Xiaojiang and others},
  booktitle={Proceedings of the 42nd International Conference on Machine Learning},
  year={2025},
  organization={ML Research Press}
}

PromptEVC: Controllable Emotional Voice Conversion with Natural Language Prompts

arXiv 2025 Voice Conversion

Qi, Tianhua; Wang, Shiyan; Lu, Cheng; Song, Tengfei; Yang, Hao; Wu, Zhanglin; Zheng, Wenming.

@article{qi2025promptevc}
@article{qi2025promptevc,
  title={PromptEVC: Controllable Emotional Voice Conversion with Natural Language Prompts},
  author={Qi, Tianhua and Wang, Shiyan and Lu, Cheng and Song, Tengfei and Yang, Hao and Wu, Zhanglin and Zheng, Wenming},
  journal={arXiv preprint arXiv:2505.20678},
  year={2025}
}

OmniOPSD: Rationale-Privileged On-Policy Self-Distillation for Affective Computing

arXiv 2026 Affective Computing

Cheng, Zebang; Chen, Shuimu; Yang, Boxue; Guan, Yuanshen; Chen, Jingyi; Lian, Zheng; Peng, Xiaojiang; Ma, Fei; Cui, LaiZhong; Tian, Qi.

@article{cheng2026omniopsd}
@article{cheng2026omniopsd,
  title={OmniOPSD: Rationale-Privileged On-Policy Self-Distillation for Affective Computing},
  author={Cheng, Zebang and Chen, Shuimu and Yang, Boxue and Guan, Yuanshen and Chen, Jingyi and Lian, Zheng and Peng, Xiaojiang and Ma, Fei and Cui, LaiZhong and Tian, Qi},
  journal={arXiv preprint arXiv:2606.15920},
  year={2026}
}

EEG and Neural Signal Modeling

Foundation models, interpretable neural-signal analysis, and EEG-based machine learning references.

5 references

REVE: A foundation model for EEG-adapting to any setup with large-scale pretraining on 25,000 subjects

NeurIPS 2026 Foundation Model

El Ouahidi, Yassine; Lys, Jonathan; Tholke, Philipp; Farrugia, Nicolas; Pasdeloup, Bastien; Gripon, Vincent; Jerbi, Karim; Lioi, Giulia.

@article{el2026reve}
@article{el2026reve,
  title={REVE: A foundation model for EEG-adapting to any setup with large-scale pretraining on 25,000 subjects},
  author={El Ouahidi, Yassine and Lys, Jonathan and Th{\"o}lke, Philipp and Farrugia, Nicolas and Pasdeloup, Bastien and Gripon, Vincent and Jerbi, Karim and Lioi, Giulia},
  journal={Advances in Neural Information Processing Systems},
  volume={38},
  pages={22541--22577},
  year={2026}
}

E^2-LLM: Bridging Neural Signals and Interpretable Affective Analysis

arXiv 2026 Neural Signals

Ma, Fei; Lin, Han; Xie, Yifan; Ren, Hongwei; Shen, Xiaoyu; Ding, Wenbo; Tian, Qi.

@article{ma20262}
@article{ma20262,
  title={E\^{} 2-LLM: Bridging Neural Signals and Interpretable Affective Analysis},
  author={Ma, Fei and Lin, Han and Xie, Yifan and Ren, Hongwei and Shen, Xiaoyu and Ding, Wenbo and Tian, Qi},
  journal={arXiv preprint arXiv:2601.07877},
  year={2026}
}

Evaluating Class Imbalance Techniques in EEG-Based Machine Learning Models for Parkinson's Disease Detection

IEEE BIBM 2025 Class Imbalance

Cherifi, Dalila; Ahmed-Zaid, Tinhinene; Boukmouri, Sarah; Boubchir, Larbi.

@INPROCEEDINGS{11356324}
@INPROCEEDINGS{11356324,
  author={Cherifi, Dalila and Ahmed-Zaid, Tinhinene and Boukmouri, Sarah and Boubchir, Larbi},
  booktitle={2025 IEEE International Conference on Bioinformatics and Biomedicine (BIBM)}, 
  title={Evaluating Class Imbalance Techniques in EEG-Based Machine Learning Models for Parkinson's Disease Detection}, 
  year={2025},
  volume={},
  number={},
  pages={5817-5821},
  keywords={Support vector machines;Parkinson's disease;Brain modeling;Feature extraction;Electroencephalography;Data models;Numerical models;Long short term memory;Random forests;Classification tree analysis;Parkinson's disease;EEG;Machine Learning;Classification;Class imbalance},
  doi={10.1109/BIBM66473.2025.11356324}}

EEG-VL: Integrating Visual Features with Large Language Models for Automated Seizure Detection

IEEE BIBM 2025 Seizure Detection

Liang, Zi; Hu, Peng; Li, Lian; Cheng, Zebang; Dong, Yisu; He, Haibo; Lu, Qiang; Lin, Nan.

@inproceedings{liang2025eeg}
@inproceedings{liang2025eeg,
  title={EEG-VL: Integrating Visual Features with Large Language Models for Automated Seizure Detection},
  author={Liang, Zi and Hu, Peng and Li, Lian and Cheng, Zebang and Dong, Yisu and He, Haibo and Lu, Qiang and Lin, Nan},
  booktitle={2025 IEEE International Conference on Bioinformatics and Biomedicine (BIBM)},
  pages={4620--4627},
  year={2025},
  organization={IEEE}
}

REFED: a subject real-time dynamic labeled EEG-fNIRS synchronized recorded emotion dataset

NeurIPS 2026 EEG-fNIRS Dataset

Ning, Xiaojun; Wang, Jing; Feng, Zhiyang; Xin, Tianzuo; Zhang, Shuo; Zhang, Shaoqi; Lian, Zheng; Ding, Yi; Lin, Youfang; Jia, Ziyu.

@article{ning2026refed}
@article{ning2026refed,
  title={REFED: a subject real-time dynamic labeled EEG-fNIRS synchronized recorded emotion dataset},
  author={Ning, Xiaojun and Wang, Jing and Feng, Zhiyang and Xin, Tianzuo and Zhang, Shuo and Zhang, Shaoqi and Lian, Zheng and Ding, Yi and Lin, Youfang and Jia, Ziyu},
  journal={Advances in Neural Information Processing Systems},
  volume={38},
  year={2026}
}

Personality Assessment

References for video interviews, personality-aware modeling, and cognitive assessment.

3 references

Assessing personality traits and interview performance from asynchronous video interviews

ACM Multimedia 2025 Video Interviews

Zhang, Tianyi; Qi, Tianhua; Koutsoumpis, Antonis; Zong, Yuan; Zheng, Wenming; Oostrom, Janneke K; Holtrop, Djurre; Luo, Zhaojie; De Vries, Reinout E.

@inproceedings{zhang2025assessing}
@inproceedings{zhang2025assessing,
  title={Assessing personality traits and interview performance from asynchronous video interviews},
  author={Zhang, Tianyi and Qi, Tianhua and Koutsoumpis, Antonis and Zong, Yuan and Zheng, Wenming and Oostrom, Janneke K and Holtrop, Djurre and Luo, Zhaojie and De Vries, Reinout E},
  booktitle={Proceedings of the 33rd ACM International Conference on Multimedia},
  pages={13895--13900},
  year={2025}
}

AVI Challenge 2026: Assessing True Personality Traits and Cognitive Ability from Asynchronous Video Interviews (AVIs)

ACM Multimedia 2026 Challenge

Zhang, Tianyi; Qi, Tianhua; De Vries, Reinout E; Zheng, Wenming; Oostrom, Janneke K; Holtrop, Djurre; Zong, Yuan; Koutsoumpis, Antonis.

@inproceedings{zhang2026avimgc}
@inproceedings{zhang2026avimgc,
  title={AVI Challenge 2026: Assessing True Personality Traits and Cognitive Ability from Asynchronous Video Interviews (AVIs)},
  author={Zhang, Tianyi and Qi, Tianhua and De Vries, Reinout E, and Zheng, Wenming and Oostrom, Janneke K and Holtrop, Djurre and Zong, Yuan and Koutsoumpis, Antonis},
  booktitle={Proceedings of the 34th ACM International Conference on Multimedia},
  year={2026}
}

Multi-Level Segment Fusion Based on Adaptive Time-Window Selection for Multimodal Personality-Aware Elderly Depression Detection

ACM Multimedia 2025 Depression Detection

Liu, Yuyun; Zhang, Kaifei; Ma, Yinghao; Xu, Xiaolin; Qi, Tianhua; Zheng, Wenming; Lu, Cheng; Zong, Yuan.

@inproceedings{liu2025multi}
@inproceedings{liu2025multi,
  title={Multi-Level Segment Fusion Based on Adaptive Time-Window Selection for Multimodal Personality-Aware Elderly Depression Detection},
  author={Liu, Yuyun and Zhang, Kaifei and Ma, Yinghao and Xu, Xiaolin and Qi, Tianhua and Zheng, Wenming and Lu, Cheng and Zong, Yuan},
  booktitle={Proceedings of the 33rd ACM International Conference on Multimedia},
  pages={13944--13950},
  year={2025}
}

Depression Assessment

References for multimodal depression detection, explainability, graph models, and personality-aware assessment.

5 references

MPDD-AVG: Multimodal Personality-Aware Depression Detection via Audio-Visual Interview and Gait Analysis

2026 Audio-Visual Gait Analysis

Fu, Changzeng; Zhang, Yiming; Shang, Ming; Zhao, Shiqi; Meneses, Alexis; Luo, Zhaojie; Liu, Chaoran; Yoshikawa, Yuichiro; Ishiguro, Hiroshi; Schuller, Bjorn.

@article{fu2026mpdd}
@article{fu2026mpdd,
  title={MPDD-AVG: Multimodal Personality-Aware Depression Detection via Audio-Visual Interview and Gait Analysis},
  author={Fu, Changzeng and Zhang, Yiming and Shang, Ming and Zhao, Shiqi and Meneses, Alexis and Luo, Zhaojie and Liu, Chaoran and Yoshikawa, Yuichiro and Ishiguro, Hiroshi and Schuller, Bj{\"o}rn},
  year={2026}
}

Explainable depression assessment from face videos by weakly supervised learning

AAAI 2026 Explainability

Liao, Rongfan; Kong, Xiangyu; Tang, Shiqing; He, Lang; Fu, Changzeng; Xie, Weicheng; Liu, Xiaofeng; Liu, Lu; Song, Siyang.

@inproceedings{liao2026explainable}
@inproceedings{liao2026explainable,
  title={Explainable depression assessment from face videos by weakly supervised learning},
  author={Liao, Rongfan and Kong, Xiangyu and Tang, Shiqing and He, Lang and Fu, Changzeng and Xie, Weicheng and Liu, Xiaofeng and Liu, Lu and Song, Siyang},
  booktitle={Proceedings of the AAAI Conference on Artificial Intelligence},
  volume={40},
  number={3},
  pages={1928--1936},
  year={2026}
}

On the Use of Graph Convolutional Network for Detecting Major Depressive Disorders using EEG Signals

IEEE BIBM 2025 GCN + EEG

Alaimia, Zakaria; Boubchir, Larbi; Elmir, Youssef.

@inproceedings{alaimia2025use}
@inproceedings{alaimia2025use,
  title={On the Use of Graph Convolutional Network for Detecting Major Depressive Disorders using EEG Signals},
  author={Alaimia, Zakaria and Boubchir, Larbi and Elmir, Youssef},
  booktitle={2025 IEEE International Conference on Bioinformatics and Biomedicine (BIBM)},
  pages={6944--6949},
  year={2025},
  organization={IEEE}
}

Personality-guided public-private domain disentangled hypergraph-former network for multimodal depression detection

AAAI 2026 Hypergraph

Fu, Changzeng; Zhao, Shiwen; Zhang, Yunze; Jian, Zhongquan; Zhao, Shiqi; Liu, Chaoran.

@inproceedings{fu2026personality}
@inproceedings{fu2026personality,
  title={Personality-guided public-private domain disentangled hypergraph-former network for multimodal depression detection},
  author={Fu, Changzeng and Zhao, Shiwen and Zhang, Yunze and Jian, Zhongquan and Zhao, Shiqi and Liu, Chaoran},
  booktitle={Proceedings of the AAAI Conference on Artificial Intelligence},
  volume={40},
  number={3},
  pages={1801--1809},
  year={2026}
}

Face Video Steganography for Privacy-protection Automatic Depression Assessment

ICCV 2025 Privacy Protection

Ni, Xinyi; Wu, Zijian; Liu, Lu; Song, Siyang.

@inproceedings{ni2025face}
@inproceedings{ni2025face,
  title={Face Video Steganography for Privacy-protection Automatic Depression Assessment},
  author={Ni, Xinyi and Wu, Zijian and Liu, Lu and Song, Siyang},
  booktitle={Proceedings of the IEEE/CVF International Conference on Computer Vision},
  pages={80--86},
  year={2025}
}

Facial Reaction Generation

References for multiple appropriate facial reaction generation, reaction distribution learning, and EEG-aware response prediction.

3 references

REACT 2026: The Fourth Multiple Appropriate Facial Reaction Generation Challenge: Personalised MAFRG and Appropriate EEG Reaction Prediction

arXiv 2026 Challenge

Song, Siyang; Spitale, Micol; Wu, Zijian; Kong, Xiangyu; Luo, Cheng; Palmero, Cristina; Barquero, German; Escalera, Sergio; Valstar, Michel; Daoudi, Mohamed; and others.

@article{song2026react}
@article{song2026react,
  title={REACT 2026: The Fourth Multiple Appropriate Facial Reaction Generation Challenge: Personalised MAFRG and Appropriate EEG Reaction Prediction},
  author={Song, Siyang and Spitale, Micol and Wu, Zijian and Kong, Xiangyu and Luo, Cheng and Palmero, Cristina and Barquero, German and Escalera, Sergio and Valstar, Michel and Daoudi, Mohamed and others},
  journal={arXiv preprint arXiv:2606.07935},
  year={2026}
}

Reversible graph neural network-based reaction distribution learning for multiple appropriate facial reactions generation

IEEE TAFFC 2026 Reaction Learning

Xu, Tong; Spitale, Micol; Tang, Hao; Liu, Lu; Gunes, Hatice; Song, Siyang.

@article{xu2026reversible}
@article{xu2026reversible,
  title={Reversible graph neural network-based reaction distribution learning for multiple appropriate facial reactions generation},
  author={Xu, Tong and Spitale, Micol and Tang, Hao and Liu, Lu and Gunes, Hatice and Song, Siyang},
  journal={IEEE Transactions on Affective Computing},
  year={2026},
  publisher={IEEE}
}

MReactor: Offline Multiple Appropriate Facial Reaction Generation with Hierarchical Cognitive Disentanglement

CVPR 2026 Facial Reaction

Luo, Jiachen; He, Jiajun; Shen, Shuai; Wang, Lin; Phan, Huy; Reiss, Joshua; Haijun, Lin; Schuller, Bjoern; Fu, Zeyu; Song, Siyang.

@inproceedings{luo2026mreactor}
@inproceedings{luo2026mreactor,
  title={MReactor: Offline Multiple Appropriate Facial Reaction Generation with Hierarchical Cognitive Disentanglement},
  author={Luo, Jiachen and He, Jiajun and Shen, Shuai and Wang, Lin and Phan, Huy and Reiss, Joshua and Haijun, Lin and Schuller, Bjoern and Fu, Zeyu and Song, Siyang},
  booktitle={Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition},
  pages={3354--3363},
  year={2026}
}

Speech Emotion Recognition

References for speech emotion recognition, emotional speech generation, and cross-corpus adaptation.

3 references

Low-rank joint distribution adaptation for cross-corpus speech emotion recognition

Knowledge-Based Systems 2025 Speech Emotion

Li, Sunan; Lu, Cheng; Zhao, Yan; Lian, Hailun; Qi, Tianhua; Zong, Yuan.

@article{li2025low}
@article{li2025low,
  title={Low-rank joint distribution adaptation for cross-corpus speech emotion recognition},
  author={Li, Sunan and Lu, Cheng and Zhao, Yan and Lian, Hailun and Qi, Tianhua and Zong, Yuan},
  journal={Knowledge-Based Systems},
  volume={315},
  pages={113260},
  year={2025},
  publisher={Elsevier}
}

Speaker-independent speech emotion recognition using group sparse-based adversarial local fisher discriminant analysis

Pattern Recognition 2026 Speaker-Independent

Lu, Cheng; Zhang, Kaifei; Lian, Hailun; Li, Sunan; Qi, Tianhu; Zong, Yuan; Zheng, Wenming.

@article{lu2026speaker}
@article{lu2026speaker,
  title={Speaker-independent speech emotion recognition using group sparse-based adversarial local fisher discriminant analysis},
  author={Lu, Cheng and Zhang, Kaifei and Lian, Hailun and Li, Sunan and Qi, Tianhu and Zong, Yuan and Zheng, Wenming},
  journal={Pattern Recognition},
  pages={113419},
  year={2026},
  publisher={Elsevier}
}

AffectSpeech: A Large-Scale Emotional Speech Dataset with Fine-Grained Textual Descriptions for Speech Emotion Captioning and Synthesis

arXiv 2026 Emotional Speech

Qi, Tianhua; Zheng, Wenming; Schuller, Bjorn W; Luo, Zhaojie; Li, Haizhou.

@article{qi2026affectspeech}
@article{qi2026affectspeech,
  title={AffectSpeech: A Large-Scale Emotional Speech Dataset with Fine-Grained Textual Descriptions for Speech Emotion Captioning and Synthesis},
  author={Qi, Tianhua and Zheng, Wenming and Schuller, Bj{\"o}rn W and Luo, Zhaojie and Li, Haizhou},
  journal={arXiv preprint arXiv:2604.04160},
  year={2026}
}

Generative Affective Media

References for generative affective computing, emotion synthesis, human motion video generation, and digital human interaction.

6 references

DisenEmo: Learning disentangled emotional representation from facial motion for 3D talking head generation

ICIP 2025 Talking Head

Chen, Ziang; Qi, Tianhua; Lu, Cheng; Zheng, Wenming.

@inproceedings{chen2025disenemo}
@inproceedings{chen2025disenemo,
  title={DisenEmo: Learning disentangled emotional representation from facial motion for 3D talking head generation},
  author={Chen, Ziang and Qi, Tianhua and Lu, Cheng and Zheng, Wenming},
  booktitle={2025 IEEE International Conference on Image Processing (ICIP)},
  pages={289--294},
  year={2025},
  organization={IEEE}
}

Enhancing zero-shot emotional voice conversion via speaker adaptation and duration prediction

ICASSP 2025 Voice Conversion

Wang, Shiyan; Qi, Tianhua; Lu, Cheng; Luo, Zhaojie; Zheng, Wenming.

@inproceedings{wang2025enhancing}
@inproceedings{wang2025enhancing,
  title={Enhancing zero-shot emotional voice conversion via speaker adaptation and duration prediction},
  author={Wang, Shiyan and Qi, Tianhua and Lu, Cheng and Luo, Zhaojie and Zheng, Wenming},
  booktitle={ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)},
  pages={1--5},
  year={2025},
  organization={IEEE}
}

Generative technology for human emotion recognition: A scoping review

Information Fusion 2025 Scoping Review

Ma, Fei; Yuan, Yucheng; Xie, Yifan; Ren, Hongwei; Liu, Ivan; He, Ying; Ren, Fuji; Yu, Fei Richard; Ni, Shiguang.

@article{ma2025generative}
@article{ma2025generative,
  title={Generative technology for human emotion recognition: A scoping review},
  author={Ma, Fei and Yuan, Yucheng and Xie, Yifan and Ren, Hongwei and Liu, Ivan and He, Ying and Ren, Fuji and Yu, Fei Richard and Ni, Shiguang},
  journal={Information Fusion},
  volume={115},
  pages={102753},
  year={2025},
  month={Mar},
  publisher={Elsevier BV},
  doi={10.1016/j.inffus.2024.102753}
}

A Review of Human Emotion Synthesis Based on Generative Technology

IEEE TAFFC 2025 Emotion Synthesis

Ma, Fei; Xie, Yifan; Li, Yukan; He, Ying; Zhang, Yi; Ren, Hongwei; Liu, Zhou; Yao, Wei; Ren, Fuji; Yu, Fei Richard; Ni, Shiguang.

@article{ma2025reviewemotion}
@article{ma2025reviewemotion,
  title={A Review of Human Emotion Synthesis Based on Generative Technology},
  author={Ma, Fei and Xie, Yifan and Li, Yukan and He, Ying and Zhang, Yi and Ren, Hongwei and Liu, Zhou and Yao, Wei and Ren, Fuji and Yu, Fei Richard and Ni, Shiguang},
  journal={IEEE Transactions on Affective Computing},
  volume={16},
  number={4},
  pages={2579--2598},
  year={2025},
  month={Oct},
  publisher={Institute of Electrical and Electronics Engineers (IEEE)},
  doi={10.1109/TAFFC.2025.3573878}
}

Human Motion Video Generation: A Survey

IEEE TPAMI 2025 Human Motion Video

Xue, Haiwei; Luo, Xiangyang; Hu, Zhanghao; Zhang, Xin; Xiang, Xunzhi; Dai, Yuqin; Liu, Jianzhuang; Zhang, Zhensong; Li, Minglei; Yang, Jian; Ma, Fei; Wu, Zhiyong; Yang, Changpeng; Dai, Zonghong; Yu, Fei Richard.

@article{xue2025humanmotion}
@article{xue2025humanmotion,
  title={Human Motion Video Generation: A Survey},
  author={Xue, Haiwei and Luo, Xiangyang and Hu, Zhanghao and Zhang, Xin and Xiang, Xunzhi and Dai, Yuqin and Liu, Jianzhuang and Zhang, Zhensong and Li, Minglei and Yang, Jian and Ma, Fei and Wu, Zhiyong and Yang, Changpeng and Dai, Zonghong and Yu, Fei Richard},
  journal={IEEE Transactions on Pattern Analysis and Machine Intelligence},
  volume={47},
  number={11},
  pages={10709--10730},
  year={2025},
  month={Nov},
  publisher={Institute of Electrical and Electronics Engineers (IEEE)},
  doi={10.1109/TPAMI.2025.3594034}
}

PointTalk: Audio-Driven Dynamic Lip Point Cloud for 3D Gaussian-based Talking Head Synthesis

AAAI 2025 Talking Head

Xie, Yifan; Feng, Tao; Zhang, Xin; Luo, Xiangyang; Guo, Zixuan; Yu, Weijiang; Chang, Heng; Ma, Fei; Yu, Fei Richard.

@article{xie2025pointtalk}
@article{xie2025pointtalk,
  title={PointTalk: Audio-Driven Dynamic Lip Point Cloud for 3D Gaussian-based Talking Head Synthesis},
  author={Xie, Yifan and Feng, Tao and Zhang, Xin and Luo, Xiangyang and Guo, Zixuan and Yu, Weijiang and Chang, Heng and Ma, Fei and Yu, Fei Richard},
  journal={Proceedings of the AAAI Conference on Artificial Intelligence},
  volume={39},
  number={8},
  pages={8753--8761},
  year={2025},
  month={Apr},
  publisher={Association for the Advancement of Artificial Intelligence (AAAI)},
  doi={10.1609/aaai.v39i8.32946}
}

Emotion Recognition

References for multimodal emotion recognition, affective computing challenges, and generative emotion understanding.

5 references

HiMul-LGG: A hierarchical decision fusion-based local-global graph neural network for multimodal emotion recognition in conversation

Neural Networks 2025 Emotion Recognition

Fu, Changzeng; Qian, Fengkui; Su, Kaifeng; Su, Yikai; Wang, Ze; Shi, Jiaqi; Liu, Zhigang; Liu, Chaoran; Ishi, Carlos Toshinori.

@article{fu2025himul}
@article{fu2025himul,
  title={HiMul-LGG: A hierarchical decision fusion-based local--global graph neural network for multimodal emotion recognition in conversation},
  author={Fu, Changzeng and Qian, Fengkui and Su, Kaifeng and Su, Yikai and Wang, Ze and Shi, Jiaqi and Liu, Zhigang and Liu, Chaoran and Ishi, Carlos Toshinori},
  journal={Neural Networks},
  volume={181},
  pages={106764},
  year={2025},
  publisher={Elsevier}
}

Semi-supervised multimodal emotion recognition with expression mae

ACM Multimedia 2023 Semi-Supervised

Cheng, Zebang; Lin, Yuxiang; Chen, Zhaoru; Li, Xiang; Mao, Shuyi; Zhang, Fan; Ding, Daijun; Zhang, Bowen; Peng, Xiaojiang.

@inproceedings{cheng2023semi}
@inproceedings{cheng2023semi,
  title={Semi-supervised multimodal emotion recognition with expression mae},
  author={Cheng, Zebang and Lin, Yuxiang and Chen, Zhaoru and Li, Xiang and Mao, Shuyi and Zhang, Fan and Ding, Daijun and Zhang, Bowen and Peng, Xiaojiang},
  booktitle={Proceedings of the 31st ACM International Conference on Multimedia},
  pages={9436--9440},
  year={2023}
}

MER 2025: When affective computing meets large language models

ACM Multimedia 2025 Affective Computing

Lian, Zheng; Liu, Rui; Xu, Kele; Liu, Bin; Liu, Xuefei; Zhang, Yazhou; Liu, Xin; Li, Yong; Cheng, Zebang; Zuo, Haolin; and others.

@inproceedings{lian2025mer}
@inproceedings{lian2025mer,
  title={Mer 2025: When affective computing meets large language models},
  author={Lian, Zheng and Liu, Rui and Xu, Kele and Liu, Bin and Liu, Xuefei and Zhang, Yazhou and Liu, Xin and Li, Yong and Cheng, Zebang and Zuo, Haolin and others},
  booktitle={Proceedings of the 33rd ACM International Conference on Multimedia},
  pages={13837--13842},
  year={2025}
}

MER 2026: From Discriminative Emotion Recognition to Generative Emotion Understanding

arXiv 2026 Generative Emotion Understanding

Lian, Zheng; Peng, Xiaojiang; Xu, Kele; Jia, Ziyu; Che, Xinyi; Cheng, Zebang; Ma, Fei; Cui, Laizhong; Zhang, Yazhou; Liu, Xin; and others.

@article{lian2026mer}
@article{lian2026mer,
  title={MER 2026: From Discriminative Emotion Recognition to Generative Emotion Understanding},
  author={Lian, Zheng and Peng, Xiaojiang and Xu, Kele and Jia, Ziyu and Che, Xinyi and Cheng, Zebang and Ma, Fei and Cui, Laizhong and Zhang, Yazhou and Liu, Xin and others},
  journal={arXiv preprint arXiv:2604.19417},
  year={2026}
}

MECO: A Multimodal Dataset for Emotion and Cognitive Understanding in Older Adults

arXiv 2026 Older Adults

Chen, Hongbin; Li, Jie; Wang, Wei; Song, Siyang; Gu, Xiao; Li, Jianqing; Xiang, Wentao.

@article{chen2026meco}
@article{chen2026meco,
  title={MECO: A Multimodal Dataset for Emotion and Cognitive Understanding in Older Adults},
  author={Chen, Hongbin and Li, Jie and Wang, Wei and Song, Siyang and Gu, Xiao and Li, Jianqing and Xiang, Wentao},
  journal={arXiv preprint arXiv:2604.03050},
  year={2026}
}