基本信息

张堃博  副研究员 硕导

中国科学院自动化研究所

多模态人工智能系统全国重点实验室

模式识别北京市重点实验室


个人主页 

电子邮件: kunbo.zhang@ia.ac.cn

通信地址: 北京市海淀区中关村东路95号智能化大厦1509

邮政编码: 100190

招贤纳士

招募需求

对高水平AI原创研究与真实世界应用有长期兴趣的同学,希望你保持好奇、主动探索,在解决重要问题的过程中形成自己的判断力与创造力,为世界创造独特价值。

有意向的本科生、研究生、实习生、工程师和博士后请积极联系(也可开展远程合作),具备科研热情,具有科研经验(在基座模型、图文生成与生成检测、智能体、图像处理与分析等领域有研究、论文、编程、工程应用等经历和成果)。


资源条件

1. 独有数据资源:大规模多领域的高质量自采自建独有数据库

2. 充足资源支撑:自有及合作的灵活充足算力支撑,良好的软硬件资源

3. 全链路的指导:从数据采集到大规模使用的全链条指导经验能力


文化氛围

兼容并包、鼓励探索,个人专属培养方案,支持同学全方位快速发展


研究方向

1. AI4Science(生物医学)——通过理解多模态生物特征信息,为精准诊疗、药物开发、基础科研等领域提供精准、鲁棒、可解释的软硬一体通用型智能装备(肺、肝、乳腺、胆管、耳鼻喉、类器官、毒理等应用场景)。

2. 安全可信的人工智能  (Trustworthy AI)——科学研究评价、可信科学AI、物理可解释AI。

3. 智能系统应用  (AI Applications)——围绕行业专用问题,为工业、安全等领域提质增效。


招生专业

081104-模式识别与智能系统 


招生方向

计算机视觉、医学影像分析,智能系统应用

教育和工作经历

主持和技术负责20余项国家(国家重大仪器、国家自然基金、国家重点研发计划项目和课题、重大专项等)和省部级项目,主持并交付国内外50余项智能技术与智能系统项目,部署于世界四大洲(美国、墨西哥、波兰、巴西、中国等国家),承担建设了国家科研论文学术不端主动监测平台。

已发表论文40+篇,近五年发表SCI/EI/中文核心论文38篇(SCI 1区13篇),共申请发明和PCT专利39项(授权发明专利17项、PCT专利2项),取得软件著作权11项,参与制定已颁布6项国家标准。


教育经历:

2006-09--2011-06   State University of New York at Stony Brook   硕士、博士

2002-09--2006-06   北京理工大学   学士

工作经历
2016-06~现在, 中国科学院自动化研究所,多模态人工智能系统全国重点实验室,模式识别北京市重点实验室, 博士后(合作导师:谭铁牛院士)、助理研究员、副研究员
2011-09~2016-04,Nexteer Automotive, Michigan, U.S.(原通用汽车), 高级研发工程师
社会兼职
2025-11-02-今,中国图象图形学会, 企业联络与标准化工作委员会秘书长
2019-10-20-今,中国图象图形学会, 机器视觉专委会委员、视觉大数据专委会委员
2016-06-12-今,天津中科智能识别有限公司(原天津中科智能识别产业技术研究院), 副总经理,副院长

奖励与专利

天津市科学技术进步二等奖(2025,排名第一)

北京市科学技术进步一等奖(2025,排名第九)

天津市滨海新区科技创新领军人才(2024)

CASC科技进步一等奖(2024)

威力Wiley中国高贡献作者奖(2024)

天津市留学人员科技活动启动项目择优资助—优秀类(2018)

北京市优秀毕业生(2006)

奖励信息
(1) 国际生物特征大会最佳会议论文第二名, 其他, 2020
专利成果
( 1 ) 活体虹膜检测方法、装置、电子设备和存储介质, 发明专利, 2024, 第 2 作者, 专利号: CN117935342A

( 2 ) 步态分类方法、装置及电子设备, 发明专利, 2023, 第 3 作者, 专利号: CN116486436A

( 3 ) 基于双目液体透镜的视线估计方法、设备和存储介质, 发明专利, 2023, 第 1 作者, 专利号: CN116594172A

( 4 ) 一种视线估计装置和视线估计方法, 发明专利, 2023, 第 1 作者, 专利号: CN116483196A

( 5 ) 行为识别方法及装置, 发明专利, 2023, 第 2 作者, 专利号: CN115966017A

( 6 ) 偏振图像生成方法、装置、电子设备和可读存储介质, 发明专利, 2022, 第 1 作者, 专利号: CN115424327A

( 7 ) 一种基于偏振成像的人脸活体检测方法, 发明专利, 2020, 第 1 作者, 专利号: CN111539348A

( 8 ) 多目标人群的虹膜图像获取装置与方法, 发明专利, 2023, 第 2 作者, 专利号: CN112395949B

( 9 ) 基于模板自适应匹配瓶体标签的缺陷检测方法, 发明专利, 2022, 第 1 作者, 专利号: CN113537301B

出版信息

发表论文

  • Multi-History-Step SDE Inversion for Image Editing with Superior Regional Awareness, The 19th European Conference on Computer Vision (ECCV), 2026, 通讯作者.
  • Femtosecond Label-free imaging: A Rapid and Reliable Alternative for Intraoperative Pathological Assessment in Thoracic Oncology, The Journal of Thoracic and Cardiovascular Surgery (JTCVS) Open, 2026, 第5作者. (多模态飞秒无标记影像的胸部肿瘤术中快速诊断)
  • Exploring Near-infrared Iris Image Sequences for High Throughput Iris Recognition, IEEE Transactions on Information Forensics and Security ,2025,第3作者. 
  • Open-Vocabulary Text-Driven Human Image Generation (May, 10.1007/s11263-024-02079-7, 2024), INTERNATIONAL JOURNAL OF COMPUTER VISION, 2025, 第 4 作者  通讯作者
  • 基于拆分联邦学习的元宇宙视线交互中的隐私主动保护方法研究, 计算机科学, 2025, 第 5 作者  通讯作者
  • 基于深度学习的人脸属性编辑研究概述, 计算机应用与软件, 2025, 第 4 作者
  • Text-Driven 3D Human Generation via 2D Image Collections, IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP 2024), 第3作者 通讯作者
  • Cross-Optical Property Image Translation for Face Anti-Spoofing: From Visible to Polarization, IEEE Transactions on Information Forensics and Security, 2024, 第 2 作者  通讯作者
  • A comprehensive research on light field imaging: Theory and application, IET Computer Vision, 2024, 第 5 作者  通讯作者(2024年第四季度威立Wiley中国高贡献作者奖)
  • 三维人脸成像及重建技术综述, 中国图象图形学报, 2024, 第 2 作者
  • CASIA-iris-africa: A large-scale african iris image database, Machine Intelligence Research, 2024, 第 4 作者
  • Boosting multi-modal ocular recognition via spatial feature reconstruction and unsupervised image quality estimation, Machine Intelligence Research, 2024, 第 3 作者
  • Polarized Image Translation From Nonpolarized Cameras for Multimodal Face Anti-Spoofing, IEEE Transactions on Information Forensics and Security, 2023, 第 3 作者  通讯作者
  • AIF-LFNet: All-in-Focus Light Field Super-Resolution Method Considering the Depth-Varying Defocus, IEEE Transactions on Circuits and Systems for Video Technology, 2023, 第 5 作者
  • Multiscale Dynamic Graph Representation for Biometric Recognition With Occlusions, IEEE Transactions on Pattern Analysis and Machine Intelligence, 2023, 第 4 作者
  • Sensing micro-motion human patterns using multimodal mmradar and video signal for affective and psychological intelligence, Proceedings of the 31st ACM International Conference on Multimedia, 2023, 第 5 作者
  • Pose-appearance relational modeling for video action recognition, IEEE Transactions on Image Processing, 2022, 第 3 作者
  • A novel deep-learning pipeline for light field image based material recognition, 2020 25th International Conference on Pattern Recognition (ICPR), 2021, 第 2 作者
  • High-fidelity view synthesis for light field imaging with extended pseudo 4DCNN, IEEE Transactions on Computational Imaging, 2020, 第 3 作者
  • All-in-focus iris camera with a great capture volume, 2020 IEEE International Joint Conference on Biometrics (IJCB), 2020, 第 1 作者(Google Best Paper Runner-up 最佳论文第二名)
  • LFNet: A Novel Bidirectional Recurrent Convolutional Neural Network for Light-Field Image Super-Resolution, IEEE TRANSACTIONS ON IMAGE  PROCESSING, 2018, 第 3 作者 


参与制定标准

[1] GB/T 40660-2021 《信息安全技术 生物特征识别信息保护基本要求》

[2] GB/T 41819-2022 《信息安全技术 人脸识别数据安全要求》

[3] GB/T 41871-2022 《信息安全技术 汽车数据处理安全要求》

[4] GB/T 41988-2022 《公共安全 虹膜识别应用 图像技术要求》

[5] GB/T 41990-2022 《公共安全 虹膜识别应用 采集设备》

[6] GB/T 41989-2022 《公共安全 虹膜识别应用算法评测方法》

科研活动

科研项目

  1. 儿童异常状态与行为的多模态数据融合技术研究,,44万,子课题负责人, 国家重点研发计划“儿童异常行为精准干预关键技术研究及应用”项目, 2025-05--2028-04

  2. 人脸偏振特征及其防伪应用研究,50万元,负责人,国家自然科学基金面上项目,2025-01--2028-12

  3. 基于通用人工智能的科研论文学术不端主动监测平台(科学技术部),692万元,负责人, 国家任务, 2024-07--2024-12

  4. 基于毫米波雷达和视频振动影像多模态感知的精神疾病筛查、监测和辅助诊断, 参与, 北京市科技新星交叉课题, 2023-12--2025-10

  5. 基于弱标注信息的多模态数据标识技术研究, 50万元,负责人, 信息系统需求重点实验室开放基金课题, 2023-01--2025-06

  6. 异构融合类脑计算芯片及系统研究, 参与, 国家自然科学基金重点项目, 2023-01--2026-12

  7. 生物特征识别呈现攻击多模态检测技术研究,10万元,负责人,公安部第三研究所开放课题,2022-01--2023-12

  8. 复杂场景人员身份识别系统研究, 200万元,负责人, 国家任务, 2021-06--2024-05

  9. 群体虹膜识别的高通量计算成像方法研究,54万元,负责人,国家自然科学基金面上项目, 2021-01--2024-12

  10. 课题二,213万元,子课题负责人,国家重点研发计划,2021-12--2024-11

  11. 课题五,130万元,子课题负责人,中国科学院先导C类项目,2021-1--2021-12

  12. 课题五,240万元,课题负责人,国家重点研发计划,2019-7--2023-6

  13. 多模态感知与交互系统, 参与, 中国科学院先导A类计划课题, 2020-07--2025-06

  14. 智能技术驱动的离散制造智能装备与关键技术(天津市滨海新区),625万元,负责人地方任务2018-02--2021-02

  15. 智能计算成像技术及其在工业机器视觉中应用的研究,50万元,负责人天津市重点研发计划2017-10--2020-09

  16. 装配工艺视觉智能解析技术及应用,50万元,负责人,四川省重点研发计划(院地合作),2017-09--2020.09

  17. 复杂场景中多模态生物特征获取设备,865万元,参与(技术负责),国家重大科研仪器研制项目,2015-01--2019.12

  18. 生产线检测质量管控与智能决策技术,108万元,参与(技术负责),国家重大项目

  19. 高安全等级移动终端关键技术课题子课题,150万元,参与(技术负责),国家重点研发计划,2017-07--2020-06


部分企业委托项目

  1. AR头盔与空间交互智能运维,350万元,中国海油能源发展

  2. 自动化焊接生产线改型消缺项目,3300万元,山东能源

  3. 跑冒滴漏智能视觉检测分析,中国铝业

  4. 酒瓶标签智能检测设备,郎酒

  5. 仓储机器人智能拆垛,北汽

  6. 焦罐车视觉智能检测与预警,首钢京唐钢焦化厂

  7. 汽车零部件视觉检测与生产追溯柔性系统,宝马、福特、通用、丰田等数十个型号汽车转向和传动系统生产制造(部署于中国、美国、波兰、墨西哥、巴西等地)

合作情况

主要合作对象包括在工业、医学、科技、安全领域的科技部、公安部三所、中信所、电子四院、航天科技、中电科、中海油、蚂蚁数科、301、清华长庚、上海胸科、飞秒科技等数十家头部单位,以及北京理工大学、北京邮电大学、天津大学等科研院所。