基本信息

孙楚雄 硕导 中国科学院软件研究所  

电子邮件: chuxiong2016@iscas.ac.cn

通信地址: 北京市海淀区中关村南四街4号7号楼8层

研究领域

强化学习,多智能体系统(RL agent and LLM agent)

招生信息

招收硕士研究生,也非常欢迎以RA的形式加入课题组,通过共同合作互相了解。欢迎感兴趣的同学通过邮件联系我!

出版信息

   
发表论文
(1) DR2: Revisiting Visual Reinforcement Learning from the Dimensional Analysis Perspective, AAMAS2026, 2026, 第 1 作者
(2) TMAE: Learning Targeted Multi-Agent Exploration via Causal Inference, AAAI2026, 2026, 第 1 作者
(3) M2I2: Learning Efficient Multi-Agent Communication via Masked State Modeling and Intention Inference, AAAI2026, 2026, 第 1 作者
(4) Group Causal Policy Optimization for Post-Training Large Language Models, AAAI2026, 2026, 第 4 作者
(5) Loss of Plasticity: A New Perspective on Solving Multi-Agent Exploration for Sparse Reward Tasks, AAMAS2025, 2025, 第 2 作者  通讯作者
(6) Supporting vision-language model few-shot inference with confounder-pruned knowledge prompt, NEURAL NETWORKS, 2025, 第 4 作者  通讯作者
(7) Rethinking Generalizability and Discriminability of Self-Supervised Learning from Evolutionary Game Theory Perspective, INTERNATIONAL JOURNAL OF COMPUTER VISION, 2025, 第 4 作者
(8) Revisiting Communication Efficiency in Multi-Agent Reinforcement Learning from the Dimensional Analysis Perspective, AAMAS2025, 2025, 第 1 作者
(9) Visual Reinforcement Learning via Sequential Consistency Preserved Policy Contrast from Optimal Transport View, Neural Networks, 2025, 第 3 作者  通讯作者
(10) T2MAC: Targeted and Trusted Multi-Agent Communication through Selective Engagement and Evidence-Driven Integration, AAAI2024, 2024, 第 1 作者