基本信息
张立波 研究员 博士生导师
长期从事人工智能算法与应用的教学和科研,研究方向包括复杂场景下的目标检测与跟踪、长视频视觉定位、医学语义信息挖掘,深入探索了视觉内部语义关联和外部信息引导下的视频理解方法,提出了一系列有效提升目标检测、目标跟踪和视频生成等基础任务的算法框架,并开展了在基础科学中的实际应用,在协和、朝阳医院、阜外等多家医院实现了通过人工智能技术进行特定领域的医学辅助诊断。发表TPAMI、IJCV、NuerIPS、CVPR、ICCV等人工智能领域国际顶级会议/期刊论文80余篇,主持国家自然科学基金、国家揭榜挂帅、院重点研究计划等项目,曾获得中国人工智能学会学术奖励、中国科学院朱李月华奖,担任The Innovation期刊信息学方向编委,中国科学院信息技术与人工智能专委会委员,同时是中国作家协会会员和中国科普作家协会会员,出版图书获得科技部全国优秀科普图书、中国科学院优秀科普作品、中国龙奖提名,入选国家农家书屋推荐书目和中国计算机学会科普阅读推荐图书。
电子邮件:libo@iscas.ac.cn
研究方向:人工智能,计算机视觉,代码理解
通信地址: 中关村南四街4号中国科学院软件研究所
招生信息
- 本课题组招收有志于从事科研事业的硕士、博士、实习生。目前课题组项目主要为面向国家需求和国际前沿的科学研究项目,部分为大型合作企业的应用项目。主要方向为人工智能,计算机视觉,代码理解。建议联系与报考之前,通过近几年发表的论文,对组内的研究方向和内容进行简单了解。研究组会对有志于科研的同学进行1对1的科研指导,大部分学生在入学前能够投出或发表一篇顶级科研成果,但这意味着你将投入大量的时间和辛苦的汗水,选择我们,科研和学术工作将几乎占据你整个学生生涯,建议慎重考虑后联系。由于名额有限,为了节约彼此时间,将沟通和面试工作约束在合理范围内,请仔细阅读招生要求后联系报考。
- 保研/报考学生满足中国科学院大学和中国科学院软件研究所的基本要求,参见相关网站招生简章。
- 科研工作涉及阅读大量英文文献,撰写论文需要具备良好的写作能力,出国交流需要一定的口语能力,因此,组内要求6级英语成绩500分以上(专业技术能力特别优异者可适当放宽)。
- 组内硕士生大多数会选择转博,由于名额极其有限,因此对于转博/普博的学生要求至少发表过一篇学生第一作者的CCF A类论文。
- 联系时间:根据之前经验,组内名额建议在大二下学期/大三上学期进行提前联系,我们会及时组织组内的面试考核,尽早确定保研指标。当然,后续也需要顺利通过软件所组织的保研面试。
- 工作环境:部门配备了良好的学习环境,组内具有出色的科研氛围,同时提供了充足的计算资源。
- 关于生源:不设置本科/硕士的学校限制,也希望你相信通过自己的努力可以改变命运。认真的态度,全身心的投入,极致的热爱,都远比本科高校是哪里重要的多。
- 关于诚信:如果明确拿到组里的保研名额,后续无论有多么优秀的学生出现,也不会对之前的同学造成影响。也希望保研同学慎重考虑,信守承诺,因为后续放弃指标会对我们造成很大的影响。通过保研的学生,组内鼓励大家提前学习相关基础知识后,一般要求提前进入实验室,且本科毕业设计需与硕士方向紧密相关。
- 联系方式:如果读完以上信息,你依然决心从事科研事业,可以将简历发至libo@iscas.ac.cn
- 招生指标:组内在中国科学院软件所/中国科学院大学南京学院/中国科学院杭高院均有招生指标,来信联系时请注明报考选择(报考学生会首先进行一轮计算机基础的远程笔试)。
- Starting from 2023, a PhD student in my group must gained at least 7 points and a master student must gained 3 points before defending his/her thesis. Following is the detailed caculation:
- A+(3.0 points): T-PAMI/IJCV
- A (2.5 points): CVPR/ICCV/ECCV/NIPS/ICML/ICLR, T-IP
- A-(2.0 points): AAAI/IJCAI, T-MM/T-CSVT/T-NNLS/T-ITS/PR/CVIU
- B (1.5 points): ICME/BMVC/ICRA/IROS
出版信息
2026
- [CCF A] OmniSTVG: Toward Spatio-Temporal Omni-Object Video Grounding. Jiali Yao, Xin Gu, Xinran Deng, Mengrui Dai, Bing Fan, Zhipeng Zhang, Yan Huang, Heng Fan, Libo Zhang*. International Conference on Learning Representations (ICLR 2026).
- [CCF A] Towards Visual Query Localization in the 3D World. Liang Peng, Bohan Tan, Zhipeng Zhang, Haobo Li, Yifan Jiao, Xingping Dong, Libo Zhang. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2026).
- [CCF A] TuneAgent: Agentic Operating System Kernel Tuning with Reinforcement Learning. Hongyu Lin, Yuchen Li, Haoran Luo, Zhenghong Lin, Libo Zhang, Mingjie Xing, Yanjun Wu. ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026).
- [ECCV] FlowFace: Rectifying Identity Conditioning with Riemannian Geometry for Face Generation. Xinran Deng, Yiling Wu, Ye Tian, Libo Zhang*. European Conference on Computer Vision (ECCV 2026).
- [ECCV] Towards Long-Form Spatio-Temporal Video Grounding. Xin Gu, Bing Fan, Jiali Yao, Zhipeng Zhang, Yan Huang, Cheng Han, Heng Fan, Libo Zhang*. European Conference on Computer Vision (ECCV 2026).
- [CCF A] PanelLayout: Story-Aware Hierarchical Panel Layout Generation via Synchronized Diffusion. Ye Tian, Haiqing Ren, Xinran Deng, Yanhao Zhang, Haonan Lu, Libo Zhang*. ACM International Conference on Multimedia (ACM MM 2026).
2025
- [CCF A] Compiler-R1: Towards Agentic Compiler Auto-tuning with Reinforcement Learning. Haolin Pan, Hongyu Lin, Haoran Luo, Yang Liu, Kaichun Yao, Libo Zhang, Mingjie Xing, Yanjun Wu. Advances in Neural Information Processing Systems (NeurIPS 2025).
- [CCF A] Robust Ego-Exo Correspondence with Long-Term Memory. Yijun Hu, Bing Fan, Xin Gu, Haiqing Ren, Dongfang Liu, Heng Fan, Libo Zhang*. Advances in Neural Information Processing Systems (NeurIPS 2025).
- [CCF A] Attention to Trajectory: Trajectory-Aware Open-Vocabulary Tracking. Yunhao Li, Yifan Jiao, Dan Meng, Heng Fan, Libo Zhang*. IEEE International Conference on Computer Vision (ICCV 2025).
- [CCF A] GSOT3D: Towards Generic 3D Single Object Tracking in the Wild. Yifan Jiao, Yunhao Li, Junhua Ding, Qing Yang, Song Fu, Heng Fan, Libo Zhang*. IEEE International Conference on Computer Vision (ICCV 2025).
- [CCF A] High-Fidelity Image Inpainting with Multimodal Guided GAN Inversion. Libo Zhang, Yongsheng Yu, Jiali Yao, Heng Fan. International Journal of Computer Vision.
- [CCF A] Knowing Your Target: Target-Aware Transformer Makes Better Spatio-Temporal Video Grounding. Xin Gu, Yaojie Shen, Chenxi Luo, Tiejian Luo, Yan Huang, Yuewei Lin, Heng Fan, Libo Zhang*. International Conference on Learning Representations (ICLR 2025).
- [CCF A] Multi-Reward as Condition for Instruction-based Image Editing. Xin Gu, Ming Li, Libo Zhang, Fan Chen, Longyin Wen, Tiejian Luo, Sijie Zhu. International Conference on Learning Representations (ICLR 2025).
- [CCF B] PlanarTrack: A high-quality and challenging benchmark for large-scale planar object tracking. Yifan Jiao, Xinran Liu, Xiaoqiong Liu, Xiaohui Yuan, Heng Fan, Libo Zhang*. Computer Vision and Image Understanding.
- [CCF B] Learning to zoom: Exploiting mixed-scale contextual information for object detection. Boying Wang, Ruyi Ji, Libo Zhang, Yanjun Wu, Jing Liu. Expert Systems with Applications.
- [IROS] G3 CN: Gaussian Topology Refinement Gated Graph Convolutional Network for Skeleton-Based Action Recognition. Haiqing Ren, Zhongkai Luo, Heng Fan, Xiaohui Yuan, Guanchen Wang, Libo Zhang*. IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2025).
- [ICRA] LaMOT: Language-Guided Multi-Object Tracking. Yunhao Li, Xiaoqiong Liu, Luke Liu, Heng Fan, Libo Zhang*. IEEE International Conference on Robotics and Automation (ICRA 2025).
- [ICRA] CGTrack: Cascade Gating Network with Hierarchical Feature Aggregation for UAV Tracking. Weihong Li, Xiaoqiong Liu, Heng Fan, Libo Zhang*. IEEE International Conference on Robotics and Automation (ICRA 2025).
2024
- [CCF A] VastTrack: Vast Category Visual Object Tracking. Liang Peng, Junyuan Gao, Xinran Liu, Weihong Li, Shaohua Dong, Zhipeng Zhang, Heng Fan, Libo Zhang*. Advances in Neural Information Processing Systems (NeurIPS 2024).
- [CCF A] Robust Domain Adaptive Object Detection with Unified Multi-Granularity Alignment. Libo Zhang, Wenzhang Zhou, Heng Fan, Tiejian Luo, Haibin Ling. IEEE Transactions on Pattern Analysis and Machine Intelligence.
- [CCF A] CARL: Unsupervised Code-Based Adversarial Attacks for Programming Language Models via Reinforcement Learning. Kaichun Yao, Hao Wang, Chuan Qin, Hengshu Zhu, Yanjun Wu, Libo Zhang*. ACM Transactions on Software Engineering and Methodology.
- [CCF A] Context-Guided Spatio-Temporal Video Grounding. Xin Gu, Heng Fan, Yang Huang, Tiejian Luo, Libo Zhang*. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2024).
- [CCF A] Kernel Adaptive Convolution for Scene Text Detection via Distance Map Prediction. Jinzhi Zheng, Heng Fan, Libo Zhang*. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2024).
- [CCF A] MaGIC: Multi-modality Guided Image Completion. Yongsheng Yu, Hao Wang, Tiejian Luo, Heng Fan, Libo Zhang*. International Conference on Learning Representations (ICLR 2024).
- [CCF B] AttMOT: Improving Multiple-object Tracking by Introducing Auxiliary Pedestrian Attributes. Yunhao Li, Zhen Xiao, Lin Yang, Dan Meng, Xin Zhou, Heng Fan, Libo Zhang*. IEEE Transactions on Neural Networks and Learning Systems.
- [ECCV] Beyond MOT: Semantic Multi-Object Tracking. Yunhao Li, Hao Wang, Qin Li, Xue Ma, Jiali Yao, Shaohua Dong, Heng Fan, Libo Zhang*. European Conference on Computer Vision (ECCV 2024).
2023
- [CCF A] Local Compressed Video Stream Learning for Generic Event Boundary Detection. Libo Zhang, Xin Gu, Congcong Li, Tiejian Luo, Heng Fan. International Journal of Computer Vision.
- [CCF A] PIDray: A Large-scale X-ray Benchmark for Real-World Prohibited Item Detection. Libo Zhang, Lutao Jiang, Heng Fan, Ruyi Ji. International Journal of Computer Vision.
- [CCF A] Two Birds, One Stone: A Unified Framework for Joint Learning of Image and Video Style Transfers. Bohai Gu, Heng Fan, Libo Zhang*. IEEE International Conference on Computer Vision (ICCV 2023).
- [CCF A] Unsupervised Domain Adaptive Detection with Network Stability Analysis. Wenzhang Zhou, Heng Fan, Tiejian Luo, Libo Zhang*. IEEE International Conference on Computer Vision (ICCV 2023).
- [CCF A] Accurate and Fast Compressed Video Captioning. Yaojie Shen, Xin Gu, Kai Xu, Heng Fan, Longyin Wen, Libo Zhang*. IEEE International Conference on Computer Vision (ICCV 2023).
- [CCF A] PlanarTrack: A Large-scale Challenging Benchmark for Planar Object Tracking. Xinran Liu, Xiaoqiong Liu, Ziruo Yi, Xin Zhou, Thanh Le, Libo Zhang*, Yan Huang, Qing Yang, Heng Fan. IEEE International Conference on Computer Vision (ICCV 2023).
- [CCF A] Text with Knowledge Graph Augmented Transformer for Video Captioning. Xin Gu, Guang Chen, Yufei Wang, Libo Zhang*, Tiejian Luo, Longyin Wen. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2023).
- Visual Object Tracking: Progress, Challenge, and Future. Libo Zhang, Heng Fan. The Innovation.
- [CCF B] Dual Transformer with Multi-Grained Assembly for Fine-Grained Visual Classification. Ruyi Ji, Jiaying Li, Libo Zhang*, Jing Liu, Yanjun Wu. IEEE Transactions on Circuits and Systems for Video Technology.
- [CCF B] Siamese Self-supervised Learning for Fine-Grained Visual Classification. Ruyi Ji, Jiaying Li, Libo Zhang*. Computer Vision and Image Understanding.
- [CCF B] Collaborative Three-stream Transformers for Video Captioning. Haowang, Libo Zhang*, Heng Fan, Tiejian Luo. Computer Vision and Image Understanding.
2022
- [CCF A] AnimalTrack: A Large-scale Benchmark for Multi-Animal Tracking in the Wild. Libo Zhang, Junyuan Gao, Zhen Xiao, Heng Fan. International Journal of Computer Vision.
- [CCF A] Multi-Granularity Alignment Domain Adaptation for Object Detection. Wenzhang Zhou, Dawei Du, Libo Zhang*, Tiejian Luo, Yanjun Wu. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2022).
- [CCF A] End-to-End Compressed Video Representation Learning for Generic Event Boundary Detection. Congcong Li, Xinyao Wang, Longyin Wen, Dexiang Hong, Tiejian Luo, Libo Zhang*. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2022).
- [CCF A] LD-ConGR: A Large RGB-D Video Dataset for Long-Distance Continuous Gesture Recognition. Dan Liu, Libo Zhang*, Yanjun Wu. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2022).
- [ECCV] High-Fidelity Image Inpainting with GAN Inversion. Yongsheng Yu, Libo Zhang*, Heng Fan, Tiejian Luo. European Conference on Computer Vision (ECCV 2022).
- [ECCV] Unbiased Multi-Modality Guidance for Image Inpainting. Yongsheng Yu, Dawei Du, Libo Zhang*, Tiejian Luo. European Conference on Computer Vision (ECCV 2022).
- [ECCV] AutoTransition: Learning to Recommend Video Transition Effects. Yaojie Shen, Libo Zhang, Kai Xu, Xiaojie Jin. European Conference on Computer Vision (ECCV 2022).
- [CCF A] ROG: A High Performance and Robust Distributed Training System for Robotic IoT. Xiuxian Guan, Zekai Sun, Shengliang Deng, Xusheng Chen, Shixiong Zhao, Zongyuan Zhang, Tianyang Duan, Yuexuan Wang, Chenshu Wu, Yong Cui, Libo Zhang, Yanjun Wu, Rui Wang, Heming Cui. IEEE/ACM International Symposium on Microarchitecture (MICRO 2022).
- [CCF B] COORP: Satisfying Low-Latency and High-Throughput Requirements of Wireless Network for Coordinated Robotic Learning. Shengliang Deng, Xiuxian Guan, Zekai Sun, Shixiong Zhao, Tianxiang Shen, Xusheng Chen, Tianyang Duan, Yuexuan Wang, Jia Pan, Yanjun Wu, Libo Zhang, Heming Cui. IEEE Internet of Things Journal.
- [CCF B] Bridging Multi-Scale Context-Aware Representation for Object Detection. Boying Wang, Ruyi Ji, Libo Zhang, Yanjun Wu. IEEE Transactions on Circuits and Systems for Video Technology.
2021
- [CCF A] Toward Real-World Prohibited Item Detection: A Large-Scale X-ray Benchmark. Boying Wang, Libo Zhang*, Xianglong Liu, Yanjun Wu. IEEE International Conference on Computer Vision (ICCV 2021).
- [CCF A] Towards Real-world X-ray Security Inspection: A High-Quality Benchmark And Lateral Inhibition Module For Prohibited Items Detection. Renshuai Tao, Yanlu Wei, Xiangjian Jiang, Hainan Li, Haotong Qin, Jiakai Wang, Yuqing Ma, Libo Zhang, Xianglong Liu. IEEE International Conference on Computer Vision (ICCV 2021).
- [CCF A] Graph Regularized Flow Attention Network for Video Animal Counting from Drones. Pengfei Zhu, Tao Peng, Dawei Du, Hongtao Yu, Libo Zhang, Shenglei Pei, Qinghua Hu. IEEE Transactions on Image Processing.
- [CCF A] SiamCAN: Real-Time Visual Tracking Based on Siamese Center-Aware Network. Wenzhang Zhou, Longyin Wen, Libo Zhang*, Dawei Du, Tiejian Luo, Yanjun Wu. IEEE Transactions on Image Processing.
- [CCF A] Rethinking Object Detection in Retail Stores. Yuanqiang Cai, Longyin Wen, Libo Zhang*, Dawei Du, Weiqiang Wang. AAAI Conference on Artificial Intelligence (AAAI 2021).
- [CCF A] Artificial Intelligence: A Powerful Paradigm for Scientific Research. Yongjun Xu, ..., Libo Zhang*, ... The Innovation.
Before 2020
- [CCF B] Multi-Peak Graph based Multi-Instance Learning for Weakly Supervised Object Detection. Ruyi Ji, Zeyu Liu, Libo Zhang*, Jianwei Liu, Xin Zuo, Yanjun Wu, Chen Zhao, Haofeng Wang, Lin Yang. ACM Transactions on Multimedia Computing, Communications, and Applications.
- [CCF A] Iterative Knowledge Distillation for Automatic Check-Out. Libo Zhang, Dawei Du, Congcong Li, Yanjun Wu, Tiejian Luo. IEEE Transactions on Multimedia.
- [CCF B] Scale-residual Learning Network for Scene Text Detection. Yuanqiang Cai, Chang Liu, Peirui Cheng, Dawei Du, Libo Zhang, Weiqiang Wang, Qixiang Ye. IEEE Transactions on Circuits and Systems for Video Technology.
- [CCF A] 一种适应GPU的混合访问缓存索引框架. 张鸿骏, 武延军, 张珩, 张立波. 软件学报.
- [CCF A] Guided Attention Network for Object Detection and Counting on Drones. Yuanqiang Cai, Dawei Du, Libo Zhang*, Longyin Wen, Weiqiang Wang, Yanjun Wu, Siwei Lyu. ACM International Conference on Multimedia (ACM MM 2020).
- [CCF A] Occluded Prohibited Items Detection: An X-ray Security Inspection Benchmark and De-occlusion Attention Module. Yanlu Wei, Renshuai Tao, Zhangjie Wu, Yuqing Ma, Libo Zhang, Xianglong Liu. ACM International Conference on Multimedia (ACM MM 2020).
- [ECCV] Learning Semantic Neural Tree for Human Parsing. Ruyi Ji, Dawei Du, Libo Zhang*, Longyin Wen, Yanjun Wu, Chen Zhao, Feiyue Huang, Siwei Lyu. European Conference on Computer Vision (ECCV 2020).
- [ECCV] Spatial Attention Pyramid Network for Unsupervised Domain Adaptation. Congcong Li, Dawei Du, Libo Zhang*, Longyin Wen, Tiejian Luo, Yanjun Wu, Pengfei Zhu. European Conference on Computer Vision (ECCV 2020).
- [CCF A] Attention Convolutional Binary Neural Tree for Fine-Grained Visual Categorization. Ruyi Ji, Longyin Wen, Libo Zhang*, Dawei Du, Yanjun Wu, Chen Zhao, Xianglong Liu, Feiyue Huang. IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR 2020).
- CACCT: An Automated Tool of Detecting Complicated Cardiac Malformations in Mouse Models. Qing Chu, Haobin Jiang, Libo Zhang, Dekun Zhu, Qianqian Yin, Hao Zhang, Bin Zhou, Wenzhang Zhou, Zhang Yue, Hong Lian, Lihui Liu, Yu Nie, Shengshou Hu. Advanced Science.
- [CCF B] Towards Interpretable and Robust Hand Detection via Pixel-wise Prediction. Dan Liu, Libo Zhang*, Tiejian Luo, Lili Tao, Yanjun Wu. Pattern Recognition.
- [CCF A] Data Priming Network for Automatic Check-Out. Congcong Li, Dawei Du, Libo Zhang*, Tiejian Luo, Yanjun Wu, Qi Tian, Longyin Wen, Siwei Lyu. ACM International Conference on Multimedia (ACM MM 2019).
- [CCF A] Scale Invariant Fully Convolutional Network: Detecting Hands Efficiently. Dan Liu, Dawei Du, Libo Zhang*, Tiejian Luo, Yanjun Wu, Feiyue Huang, Siwei Lyu. AAAI Conference on Artificial Intelligence (AAAI 2019).
- [CCF A] Teaching Machines to Ask Questions. Kaichun Yao, Libo Zhang*, Tiejian Luo, Lili Tao, Yanjun Wu. International Joint Conference on Artificial Intelligence (IJCAI 2018).