Research Interests
- Open-world Perception: Object detection and recognition in open-ended/unconstrained environments.
- Adaptive Intelligence: Continual Learning and lifelong adaptation for evolving data streams.
- Multimodal Understanding: Multimodal Sentiment Analysis and cross-modal content interpretation.
Work experience
- 2026.03- College of Software, Nankai University
- 2018.07-2026.03 Institute of Information Engineering, Chinese Academy of Sciences
Education
- Ph.D in University of Chinese Academy of Sciences
- M.S. in Shandong University
- B.S. in Shandong University
Publications
- Dongbao Yang, Yu Zhou, Xiaopeng Hong, Aoting Zhang, and Weiping Wang. “One-Shot Replay: Boosting incremental object detection via retrospecting one object.” AAAI, 2023. (CCF-A, Oral)
- Dongbao Yang, Yu Zhou, Xiaopeng Hong, Aoting Zhang, Xin Wei, Linchengxi Zeng, Zhi Qiao, and Weiping Wang. “Pseudo object replay and mining for incremental object detection.” ACM MM, 2023. (CCF-A, Oral)
- Dongbao Yang, Yu Zhou, Aoting Zhang, Xurui Sun, Dayan Wu, Weiping Wang, and Qixiang Ye. “Multi-view correlation distillation for incremental object detection.” PR, 2022. (中科院SCI一区, CCF-B)
- Dongbao Yang, Yu Zhou, Wei Shi, Dayan Wu, and Weiping Wang. “RD-IOD: Two-level residual-distillation-based triple-network for incremental object detection.” TOMM, 2022. (JCR SCI一区, CCF-B)
- Daiqing Wu, Dongbao Yang*, Sicheng Zhao, Can Ma, and Yu Zhou. “Customizing Visual Emotion Evaluation for MLLMs: An Open-vocabulary, Multifaceted, and Scalable Approach.” ICLR, 2026. (CCF-A)
- Daiqing Wu, Dongbao Yang*, Sicheng Zhao, Can Ma, and Yu Zhou. “An Empirical Study on Configuring In-Context Learning Demonstrations for Unleashing MLLMs’ Sentimental Perception Capability.” ICML, 2025. (CCF-A)
- Aoting Zhang, Dongbao Yang*, Chang Liu, Xiaopeng Hong, Miao Shang, Yu Zhou. “DCA: Dividing and conquering amnesia in incremental object detection.” AAAI, 2025. (CCF-A)
- Aoting Zhang, Dongbao Yang*, Chang Liu, Xiaopeng Hong, Yu Zhou. “Specifying what you know or not for multi-label class-incremental learning.” AAAI, 2025. (CCF-A)
- Daiqing Wu, Dongbao Yang, Huawen Shen, Can Ma, and Yu Zhou. “Robust multimodal sentiment analysis of image-text pairs by distribution-based feature recovery and fusion.” PR, 2025. (中科院SCI一区)
- Daiqing Wu, Dongbao Yang*, Yu Zhou, and Can Ma. “Bridging visual affective gap: Borrowing textual knowledge by learning from noisy image-text pairs.” ACM MM, 2024. (CCF-A, Oral)
- Daiqing Wu, Dongbao Yang*, Yu Zhou, and Can Ma. “Robust multimodal sentiment analysis of image-text pairs by distribution-based feature recovery and fusion.” ACM MM, 2024. (CCF-A)
- Hongtao Xie, Dongbao Yang*, Nannan Sun, Zhineng Chen, and Yongdong Zhang. “Automated pulmonary nodule detection in CT images using deep convolutional neural networks.” PR, 2019. (中科院SCI一区, CCF-B)
- Wei Li, Dezhao Luo, Dongbao Yang*, Zhenhang Li, Weiping Wang, and Yu Zhou. “The Role of Video Generation in Enhancing Data-Limited Action Understanding.” IJCAI, 2025. (CCF-A)
- Gangyan Zeng, Yuan Zhang, Jin Wei, Dongbao Yang*, Peng Zhang, Yiwen Gao, Xugong Qin, and Yu Zhou. “Focus, Distinguish, and Prompt: Unleashing CLIP for efficient and flexible scene text retrieval.” ACM MM 2024. (CCF-A)
- Xiaomeng Yang, Dongbao Yang*, Zhi Qiao, and Yu Zhou. “Accurate and robust scene text recognition via adversarial training.” ICASSP, 2024. (CCF-B)
- Xinye Yang, Dongbao Yang*, Yu Zhou, Youhui Guo, and Weiping Wang. “Mask-guided stamp erasure for real document image.” ICME, 2023. (CCF-B)
- Wei Li, Dezhao Luo, and Dongbao Yang*, and Weiping Wang. “Large language model for action anticipation.” ICANN, 2024. (CCF-C)
- Hongyu Li, Yifei Zhang, and Dongbao Yang*. “Cross-architecture relational consistency for point cloud self-supervised learning.” ICTAI, 2023. (CCF-C)
- Yanping Ma, Dongbao Yang, Hongtao Xie, and Jian Yin. “Supervised deep hashing for image content security.” MTA, 2019. (CCF-C)
- Nannan Sun, Dongbao Yang*, Shancheng Fang, Hongtao Xie. “Deep convolutional nets for pulmonary nodule detection and classification.” KSEM, 2018. (CCF-C)
- Jiahao Lyu, Wei Wang, Dongbao Yang, Jinwen Zhong, Yu Zhou. “Arbitrary Reading Order Scene Text Spotter with Local Semantics Guidance.” AAAI, 2025. (CCF-A)
- Fangmin Zhao, Weichao Zeng, Zhenhang Li, Dongbao Yang, Binbin Li, Xiaojun Bi, Yu Zhou. “Uni-DocDiff: A Unified Document Restoration Model Based on Diffusion.” ACM MM, 2025. (CCF-A)
- Xiaomeng Yang, Zhi Qiao, Jin Wei, Dongbao Yang, and Yu Zhou. “Masked and permuted implicit context learning for scene text recognition.” IEEE SPL, 2024. (CCF-C)
- Weichao Zeng, Yan Shu, Zhenhang Li, Dongbao Yang, and Yu Zhou. “TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance Control.” NeurIPS, 2024. (CCF-A)
- Yan Shu, Wei Wang, Yu Zhou, Shaohui Liu, Aoting Zhang, Dongbao Yang, and Weiping Wang. “Perceiving ambiguity and semantics without recognition: An efficient and effective ambiguous scene text detector.” ACM MM, 2023. (CCF-A)
- Chenggang Yan, Hongtao Xie, Dongbao Yang, Jian Yin, Yongdong Zhang, and Qionghai Dai. “Supervised hash coding with deep neural network for environment perception of intelligent vehicles.” TITS, 2017. (中科院SCI一区, CCF-B)
- Zhenhang Li, Yan Shu, Weichao Zeng, Dongbao Yang, and Yu Zhou. “First creating backgrounds then rendering texts: A new paradigm for visual text blending.” ECAI, 2024. (CCF-B)
- Dongbao Yang, Hongtao Xie, Jian Yin, Yizhi Liu, Chenggang Yan. “Supervised deep quantization for efficient image search.” ICMEW, 2017.
- Yudi Chen, Wei Wang, Yu Zhou, Fei Yang, Dongbao Yang, and Weiping Wang. “Self-training for domain adaptive scene text detection.” ICPR, 2021. (CCF-C)
- Zhi Qiao, Yu Zhou, Dongbao Yang, Yucan Zhou, and Weiping Wang. “SEED: Semantics enhanced encoder-decoder framework for scene text recognition.” CVPR, 2020. (CCF-A)
- Dezhao Luo, Chang Liu, Yu Zhou, Dongbao Yang, Can Ma, Qixiang Ye, and Weiping Wang. “Video cloze procedure for self-supervised spatio-temporal learning.” AAAI, 2020. (CCF-A, Oral)
- Yudi Chen, Yu Zhou, Dongbao Yang, and Weiping Wang. “Constrained relation network for character detection in scene images.” PRICAI, 2019. (CCF-C)
- Xugong Qin, Yu Zhou, Dongbao Yang, and Weiping Wang. “Curved text detection in natural scene images with semi-and weakly-supervised learning.” ICDAR, 2019. (CCF-C)
Projects
- 1)2025.01-2027.12,国家自然科学基金青年基金,增量目标检测,主持,30万元
- 2)2022.12-2025.11,科技部重点研发计划子课题,视听内容理解,主持,260万元
- 3)2025.11-2026.11,企业横向项目,多模态检索增强生成,主持,30万元
- 4)2025.12-2026.12,企业横向项目,面向监控视频的多模态信息融合摘要生成,主持,18万元
Competitions
- 1)中国人工智能·多媒体信息识别技术竞赛,手写/印刷文本OCR两项高校组冠军,2019。
- 2)ICDAR ReCTS 2019(中文招牌文字识别),“字符识别”、“端到端识别”高校组第三名,2019。
Patents
- 1)基于伪目标重放与挖掘的增量目标检测方法及装置,2023,受理号:202311216027.X
- 2)基于单目标重放的增量目标检测方法及装置,2023,受理号:202310102438.X
- 3)基于分治健忘症的增量目标检测方法和系统,2025,受理号:202510190263.1
- 4)基于明确已知和未知知识的多标签类增量学习方法和系统,2025,受理号:202510190260.8
- 5)基于对抗训练的场景文字识别方法及装置,2024,受理号:202410434598.9
- 6)基于掩模引导的去除印章噪声的图像生成方法及系统,2023,受理号:202310733846.5
- 7)基于语义强化编码器解码器框架的场景文字识别方法,2020,受理号:202010416704.2
- 8)一种基于自训练的文本检测器训练方法及系统,2020,专利号:ZL 2020 1 0428815.5
- 9)基于受限注意力模型的字符检测网络训练方法、字符检测方法和字符检测器,2019,专利号:ZL 2019 1 0614874.9
- 10)基于完形填空任务的视频自监督学习方法, 2019,专利号:ZL 2019 1 1348018.X
- 11)一种基于深度学习的图像哈希编码方法, 2017, 受理号:201710182659.7
Academic Services
- Reviewer: CVPR, ICCV, ECCV, AAAI, ACM MM, IJCAI ….
- Area Chair: ICME