基本信息

曹亚男  女  博导  中国科学院信息工程研究所

电子邮件: caoyanan@iie.ac.cn

通信地址: 北京市海淀区树村路19号中国科学院信息工程研究所

课题组主页:


个人简介

基本信息:信工所研究员,信息内容分析研究室副主任,国家级青年人才,国家重点研发计划青年科学家项目首席;

研究方向:研究方向为自然语言处理、人工智能安全,目前聚焦大模型推理及可解释机制、大语言模型水印与溯源、可信智能体等;

所获奖项:获PAKDD 2020最佳论文奖、WWW 2021最佳论文提名奖,2022年度中国电子学会科技进步二等奖;入选2018年度中国科学院青促会人才项目、2022年度中国科学院优秀导师、2023年度国科大朱李月华优秀教师、2023年度国科大领雁银奖;

学术成果:在TPAMI、TKDE、TOIS、NeurIPS、ICML等CCF-A类会议和期刊上发表60余篇学术论文;

学术任职:FCS期刊青年编委、电子学报青年编委;ACL、COLING领域委员,AAAI、IJCAI高级程序委员会委员。

承担项目:主持国家重点研发计划青年科学家项目、中国科学院科技创新重点部署项目、国家自然科学基金联合基金课题在内的20余项国家级和国家部委科研项目。

招生信息

ASCII课题组一贯提倡“快乐科研”,课题组氛围融洽,如果你具备以下特质,欢迎你加入ASCII组!

1.有强大的内驱力,对科研工作保持热情,树立高远的目标,并能推动自己不断努力到达;

2.情绪稳定、自洽,做事有责任心,能够与课题组的老师同学们一起合作,共同进步!

希望在这里,你能成为更好的自己!

教育背景

2006-09--2012-07   中国科学院计算技术研究所 智能信息处理实验室   博士
2002-09--2006-07   山东大学计算机科学与技术学院   学士

教授课程

自然语言处理实战
自然语言处理基础
深度学习与自然语言处理

组内毕业生去向

  1. 徐同学 2019年硕士毕业 美团NLP (优秀毕业论文)
  2. 张同学 2020年硕士毕业 阿里巴巴NLP 
  3. 卞同学 2020年硕士毕业 中国信息通信研究院 
  4. 李同学 2021年博士毕业 国家互联网应急协调中心 (优秀毕业论文)
  5. 康同学 2021年硕士毕业 京东管培生 (优秀毕业论文)
  6. 唐同学 2021年硕士毕业 百度大搜 (优秀毕业论文)
  7. 方同学 2022年博士毕业 京东管培生 (优秀毕业论文)
  8. 贾同学 2022年博士毕业 百度大搜(优秀毕业论文)
  9. 李同学 2022年硕士毕业 出国读博(优秀毕业论文)
  10. 周同学 2023年博士毕业 北京电子科技学院(优秀毕业论文)
  11. 王同学 2023年硕士毕业 快手
  12. 毕同学 2024年博士毕业 清华大学博士后(优秀毕业论文)
  13. 王同学 2024年博士毕业 香港科技大学博士后(优秀毕业论文)
  14. 石同学 2024年博士毕业  深信服
  15. 任同学 2024年博士毕业 信工所预聘副高、优才B计划(优秀毕业论文)
  16. 刘同学 2024年硕士毕业 阿里(优秀毕业论文)
  17. 李同学 2024年硕士毕业 信工所读博 (优秀毕业论文)
  18. 傅同学 2025年硕士毕业  美团NLP(优秀毕业论文)
  19. 胡同学 2025年硕士毕业  信工所工程师、优才C计划
  20. 张同学 2026年博士毕业 字节跳动(优秀毕业论文)
  21. 刘同学 2026年博士毕业 中国科学院计算所 特别研究助理(优秀毕业论文)
  22. 南同学 2026年硕士毕业 京东(优秀毕业论文)
  23. 孙同学 2026年硕士毕业 招商银行总行(优秀毕业论文)

学生获奖情况

1.中国科协青年科技人才培育工程博士生专项计划:宋传承(2025年度)

2.国家奖学金:张东杰(2019年度)、贾瑞鹏(2021年度)、周玉晨(2022年度)、王青悦(2023年度)、傅延赫(2024年度)、张岚雪(2025年度)

3.院长奖学金:贾瑞鹏(2022年度院长特别奖,全院仅80名)、周玉晨(2023年度)、张岚雪(2026候选)

4.朱李月华奖学金:李晓雪(2020年度)、方正(2021年度)、任昱冰(2023年度)

5.信工所所长奖学金:李晓雪(2018年度)、周玉晨(2019年度)、方正(2020年度)、李韧(2021年度) 、胡博翔(2024年度)、南艺璇(2025年度)

6.国科大优秀毕业论文:李晓雪(2021年度)、贾瑞鹏(2022年度) 、周玉晨(2023年度)

获奖情况

1. 2018年度中国科学院青年创新促进会会员 

2. 2020年度PAKDD最佳论文奖 

3. 2021年度WWW最佳论文奖提名

4. 2022年度中国电子学会科学技术进步二等奖

5.2022年度中国科学院优秀导师(院长特别奖指导教师)

6.2023年度中国科学院大学朱李月华优秀教师

7.2023年度中国科学院大学领雁银奖

8.CCL 2023 新闻脉络检测评测任务第一名

9.NLPCC 2025 大模型生成文本检测任务第一名

CCF-A类论文

  1. Rethinking LLM Watermark Detection in Black-Box Settings: A Non-Intrusive Third-Party Framework. ACL 2026. (accepted)
  2. DualGuard: Dual-stream Large Language Model Watermarking Defense against Paraphrase and Spoofing Attack. ACL 2026.(accepted)
  3. Towards Reliable Marking and Verification of AI-Generated Text via Geometry-aware Sentence-level Watermarking. ICML 2026.(accepted)
  4. Exons-Detect: Identifying and Amplifying Exonic Tokens via Hidden-State Discrepancy for Robust AI-Generated Text Detection. ACL 2026.(accepted)
  5. Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations. ACL 2026.(accepted)
  6. EA-Agent: A Structured Multi-Step Reasoning Agent for Entity Alignment. ACL 2026.(accepted)
  7. CIA: Inferring the Communication Topology from LLM-based Multi-Agent Systems. ACL 2026.(accepted)
  8. Cognitive Analysis Graph-Guided Multi-Turn Safety Enhancement for Large Language Models. ACL 2026.(accepted)
  9. AbstainGNN: Teaching Graph Neural Networks to Abstain for Graph Classification. KDD 2026.(accepted)
  10. D2TCDR: Disentangled Diffusion-Based Transfer for Cross-Domain Recommendation. TOIS 2026.
  11. PathMind: A Retrieve-Prioritize-Reason Framework for Knowledge Graph Reasoning with Large Language Models. AAAI 2026.
  12. Breaking One-Size-Fits-All: Revisiting Out-of-Distribution Detection on Graphs Under Diverse Distribution Shifts. AAAI 2026.
  13. MetaGDPO: Alleviating Catastrophic Forgetting with Metacognitive Knowledge Through Group Direct Preference Optimization. AAAI 2026.
  14. MuVaC: AVariational Causal Framework for Multimodal Sarcasm Understanding in Dialogues. WWW 2026.
  15. Generative Causality-Driven Network for Graph Multi-Task Learning. TPAMI 2025.
  16. RelationalCoder: Rethinking Complex Tables via Programmatic Relational Transformation. ACL 2025.
  17. PIG: Privacy Jailbreak Attack on LLMs via Gradient-based Iterative In-Context Optimization. ACL 2025.
  18. Reliably Bounding False Positives: A Zero-Shot Machine-Generated Text Detection Framework via Multiscaled Conformal Prediction. ACL 2025.
  19. Dynamic Evaluation with Cognitive Reasoning for Multi-turn Safety of Large Language Models. ACL 2025.
  20. Reasoning and Retrieval for Complex Semi-structured Tables via Reinforced Relational Data Transformation. SIGIR 2025.
  21. FairCDR: Transferring Fairness and User Preferences for Cross-Domain Recommendation. KDD 2025.
  22. UniFORM: Towards Unified Framework for Anomaly Detection on Graphs. AAAI 2025.
  23. Conformal Graph-level Out-of-distribution Detection with Adaptive Data Augmentation. WWW 2025.
  24. Bridging the Gap: Aligning Language Model Generation with Structured Information Extraction via Controllable State Transition. WWW 2025.
  25. Contrastive Modality-Disentangled Learning for Multimodal Recommendation. TOIS 2025.
  26. Symbiotic Watermarking Framework for Large Language Models. ACL 2025.
  27. HOT-GAN: Hilbert Optimal Transport for Generative Adversarial Network. TNNLS 2024.
  28. Graph Neural Stochastic Diffusion for Estimating Uncertainty in Node Classification. ICML 2024.
  29. Subtle Signatures, Strong Shields: Advancing Robust and Imperceptible Watermarking in Large Language Models. ACL 2024.
  30. Towards Flexible and Adaptive Neural Process for Cold-Start Recommendation. TKDE 2024.
  31. Query in Your Tongue: Reinforce Large Language Models with Retrievers for Cross-lingual Search Generative Experience. WWW 2024.
  32. Steering Large Language Models for Cross-lingual Information Retrieval. SIGIR 2024.
  33. Towards Better Entity Linking with Multi-View Enhanced Distillation. ACL 2023.
  34. Retrieve-and-Sample: Document-level Event Argument Extraction via Hybrid Retrieval Augmentation. ACL 2023.
  35. Divide, Conquer, and Combine: Mixture of Semantic-Independent Experts for Zero-Shot Dialogue State Tracking. ACL 2023.
  36. DiffusEmp: A Diffusion Model-Based Framework with Multi-Grained Control for Empathetic Response Generation. ACL 2023.
  37. Explainable Hyperbolic Temporal Point Process for User-Item Interaction Sequence Generation. TOIS 2023.
  38. Multi-Aspect Heterogeneous Graph Augmentation. WWW 2023.
  39. Neutral Utterances are Also Causes: Enhancing Conversational Causal Emotion Entailment with Social Commonsense Knowledge. IJCAI 2022.
  40. A Win-win Deal: Towards Sparse and Robust Pre-trained Language Models. NeurIPS 2022.
  41. Detach and Attach: Stylized Image Captioning without Paired Stylized Dataset. MM 2022.
  42. A GNN-based Fraud Detector with Homophilic and Heterophilic Connections. WWW 2022.
  43. Neural Label Search for Zero-Shot Multi-Lingual Extractive Summarization. ACL 2022.
  44. Deep Differential Amplifier for Extractive Summarization. ACL 2021.
  45. Flexible Non-Autoregressive Extractive Summarization with Threshold: How to Extract a Non-Fixed Number of Summary Sentences. AAAI 2021.
  46. Task-adaptive Neural Process for User Cold-Start Recommendation. WWW 2021.
  47. How Does Knowledge Graph Embedding Extrapolate to Unseen Data: A Semantic Evidence View. AAAI 2020.
  48. High Quality Candidate Generation and Sequential Graph Attention Network for Entity Linking. WWW 2020.
  49. Graph Geometry Interaction Learning. NeurIPS 2020.
  50. Type-Aware Anchor Link Prediction across Heterogeneous Networks Based on Graph Attention Network. AAAI 2020.