基本信息
汤学海  男  硕导  中国科学院信息工程研究所
电子邮件: tangxuehai@iie.ac.cn
通信地址: 北京市海淀区树村路19号
邮政编码:

研究领域

主要研究方向为人工智能安全、大模型安全等。作为项目负责人或者技术负责人,先后承担国家重点计划课题、工信部大模型服务平台等国家项目。相关研究成果发表在ACL、ICML、AAAI、EMNLP等知名国际学术会议。荣获钱伟长中文信息处理科学技术奖一等奖、中国网络空间安全协会2024十大优秀网络安全创新成果。入选中国科学院青年创新促进会。

招生信息

招收硕士研究生1-2名。

具备良好的编程基础、较强的科研兴趣与自学能力;熟悉人工智能、大模型、智能体等技术优先考虑。


招生专业

083900-网络空间安全

081203-计算机应用技术


招生方向

人工智能、大模型安全

工作经历

2020.11~现在,中国科学院信息工程研究所,高级工程师

2017.11~2020.10,中国科学院信息工程研究所,工程师

2015.07~2017.10,中国科学院信息工程研究所,研究实习研究员


出版信息

发表论文

2026年

1.Yang, Xikang, Biyu Zhou, Xuehai Tang, Jizhong Han, and Songlin Hu. Exploiting synergistic cognitive biases to bypass safety in llms. AAAI 2026

2.Lin, Liang, Miao Yu, Kaiwen Luo, Yibo Zhang, Lilan Peng, Dexian Wang, Xuehai Tang et al. Hidden in the noise: Unveiling backdoors in audio llms alignment through latent acoustic pattern triggers. AAAI 2026

3.Yang, Xikang, Xuehai Tang, Jizhong Han, and Songlin Hu. DarkCite: Unveiling Authority Bias as Implicit Rag Jailbreak Attacks. ICASSP 2026


2025年

1. Xikang Yang, Biyu Zhou, Xuehai Tang, Jizhong Han, Songlin Hu: Chain of Attack: Hide Your Intention through Multi-Turn Interrogation. ACL findings 2025

2.Peng Wang, biyu zhou, Xuehai Tang, Jizhong Han, Songlin Hu: LyapLock: Bounded Knowledge Preservation in Sequential Large Language Model Editing. EMNLP 2025

3. Lijia Lv, Yuanshu Zhao, Guan Wang, Xuehai Tang, Wen Jie, Jizhong Han, Songlin Hu: Gamma-Guard: Lightweight Residual Adapters for Robust Guardrails in Large Language Models. EMNLP 2025

4.Lijia Lv, Weigang Zhang, Xuehai Tang, Jie Wen, Feng Liu, Jizhong Han, Songlin Hu: AdaPPA: Adaptive Position Pre-Fill Jailbreak Attack Approach Targeting LLMs. ICASSP 2025

5.Ziang Yang, Lingwei Wei, Biyu Zhou, Xuehai Tang, Ruixuan Li, Songlin Hu: Segment-Recurrent Transformer with Multi-Scale Fusion for Long-Term Time Series Forecasting. ICASSP 2025