曹亚男 女 博导 中国科学院信息工程研究所
电子邮件: caoyanan@iie.ac.cn
通信地址: 北京市海淀区树村路19号中国科学院信息工程研究所
课题组主页:
个人简介
基本信息:信工所研究员,信息内容分析研究室副主任,国家级青年人才,国家重点研发计划青年科学家项目首席;
研究方向:研究方向为自然语言处理、人工智能安全,目前聚焦大模型推理及可解释机制、大语言模型水印与溯源、可信智能体等;
所获奖项:获PAKDD 2020最佳论文奖、WWW 2021最佳论文提名奖,2022年度中国电子学会科技进步二等奖;入选2018年度中国科学院青促会人才项目、2022年度中国科学院优秀导师、2023年度国科大朱李月华优秀教师、2023年度国科大领雁银奖;
学术成果:在TPAMI、TKDE、TOIS、NeurIPS、ICML等CCF-A类会议和期刊上发表60余篇学术论文;
学术任职:FCS期刊青年编委、电子学报青年编委;ACL、COLING领域委员,AAAI、IJCAI高级程序委员会委员。
承担项目:主持国家重点研发计划青年科学家项目、中国科学院科技创新重点部署项目、国家自然科学基金联合基金课题在内的20余项国家级和国家部委科研项目。
招生信息
ASCII课题组一贯提倡“快乐科研”,课题组氛围融洽,如果你具备以下特质,欢迎你加入ASCII组!
1.有强大的内驱力,对科研工作保持热情,树立高远的目标,并能推动自己不断努力到达;
2.情绪稳定、自洽,做事有责任心,能够与课题组的老师同学们一起合作,共同进步!
希望在这里,你能成为更好的自己!
教育背景
教授课程
组内毕业生去向
- 徐同学 2019年硕士毕业 美团NLP (优秀毕业论文)
- 张同学 2020年硕士毕业 阿里巴巴NLP
- 卞同学 2020年硕士毕业 中国信息通信研究院
- 李同学 2021年博士毕业 国家互联网应急协调中心 (优秀毕业论文)
- 康同学 2021年硕士毕业 京东管培生 (优秀毕业论文)
- 唐同学 2021年硕士毕业 百度大搜 (优秀毕业论文)
- 方同学 2022年博士毕业 京东管培生 (优秀毕业论文)
- 贾同学 2022年博士毕业 百度大搜(优秀毕业论文)
- 李同学 2022年硕士毕业 出国读博(优秀毕业论文)
- 周同学 2023年博士毕业 北京电子科技学院(优秀毕业论文)
- 王同学 2023年硕士毕业 快手
- 毕同学 2024年博士毕业 清华大学博士后(优秀毕业论文)
- 王同学 2024年博士毕业 香港科技大学博士后(优秀毕业论文)
- 石同学 2024年博士毕业 深信服
- 任同学 2024年博士毕业 信工所预聘副高、优才B计划(优秀毕业论文)
- 刘同学 2024年硕士毕业 阿里(优秀毕业论文)
- 李同学 2024年硕士毕业 信工所读博 (优秀毕业论文)
- 傅同学 2025年硕士毕业 美团NLP(优秀毕业论文)
- 胡同学 2025年硕士毕业 信工所工程师、优才C计划
- 张同学 2026年博士毕业 字节跳动(优秀毕业论文)
- 刘同学 2026年博士毕业 中国科学院计算所 特别研究助理(优秀毕业论文)
- 南同学 2026年硕士毕业 京东(优秀毕业论文)
- 孙同学 2026年硕士毕业 招商银行总行(优秀毕业论文)
学生获奖情况
1.中国科协青年科技人才培育工程博士生专项计划:宋传承(2025年度)
2.国家奖学金:张东杰(2019年度)、贾瑞鹏(2021年度)、周玉晨(2022年度)、王青悦(2023年度)、傅延赫(2024年度)、张岚雪(2025年度)
3.院长奖学金:贾瑞鹏(2022年度院长特别奖,全院仅80名)、周玉晨(2023年度)、张岚雪(2026候选)
4.朱李月华奖学金:李晓雪(2020年度)、方正(2021年度)、任昱冰(2023年度)
5.信工所所长奖学金:李晓雪(2018年度)、周玉晨(2019年度)、方正(2020年度)、李韧(2021年度) 、胡博翔(2024年度)、南艺璇(2025年度)
6.国科大优秀毕业论文:李晓雪(2021年度)、贾瑞鹏(2022年度) 、周玉晨(2023年度)
获奖情况
1. 2018年度中国科学院青年创新促进会会员
2. 2020年度PAKDD最佳论文奖
3. 2021年度WWW最佳论文奖提名
4. 2022年度中国电子学会科学技术进步二等奖
5.2022年度中国科学院优秀导师(院长特别奖指导教师)
6.2023年度中国科学院大学朱李月华优秀教师
7.2023年度中国科学院大学领雁银奖
8.CCL 2023 新闻脉络检测评测任务第一名
9.NLPCC 2025 大模型生成文本检测任务第一名
CCF-A类论文
- Rethinking LLM Watermark Detection in Black-Box Settings: A Non-Intrusive Third-Party Framework. ACL 2026. (accepted)
- DualGuard: Dual-stream Large Language Model Watermarking Defense against Paraphrase and Spoofing Attack. ACL 2026.(accepted)
- Towards Reliable Marking and Verification of AI-Generated Text via Geometry-aware Sentence-level Watermarking. ICML 2026.(accepted)
- Exons-Detect: Identifying and Amplifying Exonic Tokens via Hidden-State Discrepancy for Robust AI-Generated Text Detection. ACL 2026.(accepted)
- Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations. ACL 2026.(accepted)
- EA-Agent: A Structured Multi-Step Reasoning Agent for Entity Alignment. ACL 2026.(accepted)
- CIA: Inferring the Communication Topology from LLM-based Multi-Agent Systems. ACL 2026.(accepted)
- Cognitive Analysis Graph-Guided Multi-Turn Safety Enhancement for Large Language Models. ACL 2026.(accepted)
- AbstainGNN: Teaching Graph Neural Networks to Abstain for Graph Classification. KDD 2026.(accepted)
- D2TCDR: Disentangled Diffusion-Based Transfer for Cross-Domain Recommendation. TOIS 2026.
- PathMind: A Retrieve-Prioritize-Reason Framework for Knowledge Graph Reasoning with Large Language Models. AAAI 2026.
- Breaking One-Size-Fits-All: Revisiting Out-of-Distribution Detection on Graphs Under Diverse Distribution Shifts. AAAI 2026.
- MetaGDPO: Alleviating Catastrophic Forgetting with Metacognitive Knowledge Through Group Direct Preference Optimization. AAAI 2026.
- MuVaC: AVariational Causal Framework for Multimodal Sarcasm Understanding in Dialogues. WWW 2026.
- Generative Causality-Driven Network for Graph Multi-Task Learning. TPAMI 2025.
- RelationalCoder: Rethinking Complex Tables via Programmatic Relational Transformation. ACL 2025.
- PIG: Privacy Jailbreak Attack on LLMs via Gradient-based Iterative In-Context Optimization. ACL 2025.
- Reliably Bounding False Positives: A Zero-Shot Machine-Generated Text Detection Framework via Multiscaled Conformal Prediction. ACL 2025.
- Dynamic Evaluation with Cognitive Reasoning for Multi-turn Safety of Large Language Models. ACL 2025.
- Reasoning and Retrieval for Complex Semi-structured Tables via Reinforced Relational Data Transformation. SIGIR 2025.
- FairCDR: Transferring Fairness and User Preferences for Cross-Domain Recommendation. KDD 2025.
- UniFORM: Towards Unified Framework for Anomaly Detection on Graphs. AAAI 2025.
- Conformal Graph-level Out-of-distribution Detection with Adaptive Data Augmentation. WWW 2025.
- Bridging the Gap: Aligning Language Model Generation with Structured Information Extraction via Controllable State Transition. WWW 2025.
- Contrastive Modality-Disentangled Learning for Multimodal Recommendation. TOIS 2025.
- Symbiotic Watermarking Framework for Large Language Models. ACL 2025.
- HOT-GAN: Hilbert Optimal Transport for Generative Adversarial Network. TNNLS 2024.
- Graph Neural Stochastic Diffusion for Estimating Uncertainty in Node Classification. ICML 2024.
- Subtle Signatures, Strong Shields: Advancing Robust and Imperceptible Watermarking in Large Language Models. ACL 2024.
- Towards Flexible and Adaptive Neural Process for Cold-Start Recommendation. TKDE 2024.
- Query in Your Tongue: Reinforce Large Language Models with Retrievers for Cross-lingual Search Generative Experience. WWW 2024.
- Steering Large Language Models for Cross-lingual Information Retrieval. SIGIR 2024.
- Towards Better Entity Linking with Multi-View Enhanced Distillation. ACL 2023.
- Retrieve-and-Sample: Document-level Event Argument Extraction via Hybrid Retrieval Augmentation. ACL 2023.
- Divide, Conquer, and Combine: Mixture of Semantic-Independent Experts for Zero-Shot Dialogue State Tracking. ACL 2023.
- DiffusEmp: A Diffusion Model-Based Framework with Multi-Grained Control for Empathetic Response Generation. ACL 2023.
- Explainable Hyperbolic Temporal Point Process for User-Item Interaction Sequence Generation. TOIS 2023.
- Multi-Aspect Heterogeneous Graph Augmentation. WWW 2023.
- Neutral Utterances are Also Causes: Enhancing Conversational Causal Emotion Entailment with Social Commonsense Knowledge. IJCAI 2022.
- A Win-win Deal: Towards Sparse and Robust Pre-trained Language Models. NeurIPS 2022.
- Detach and Attach: Stylized Image Captioning without Paired Stylized Dataset. MM 2022.
- A GNN-based Fraud Detector with Homophilic and Heterophilic Connections. WWW 2022.
- Neural Label Search for Zero-Shot Multi-Lingual Extractive Summarization. ACL 2022.
- Deep Differential Amplifier for Extractive Summarization. ACL 2021.
- Flexible Non-Autoregressive Extractive Summarization with Threshold: How to Extract a Non-Fixed Number of Summary Sentences. AAAI 2021.
- Task-adaptive Neural Process for User Cold-Start Recommendation. WWW 2021.
- How Does Knowledge Graph Embedding Extrapolate to Unseen Data: A Semantic Evidence View. AAAI 2020.
- High Quality Candidate Generation and Sequential Graph Attention Network for Entity Linking. WWW 2020.
- Graph Geometry Interaction Learning. NeurIPS 2020.
- Type-Aware Anchor Link Prediction across Heterogeneous Networks Based on Graph Attention Network. AAAI 2020.