基本信息
艾晓琳 中国科学院自动化研究所
电子邮件: xiaolin.ai@ia.ac.cn
通信地址: 北京市海淀区中关村东路95号中国科学院自动化研究所
邮政编码: 100190
电子邮件: xiaolin.ai@ia.ac.cn
通信地址: 北京市海淀区中关村东路95号中国科学院自动化研究所
邮政编码: 100190
研究领域
群体智能,大模型,强化学习, 无人机,飞行控制
招生信息
本课题组常年招聘群体决策智能、多智能体强化学习、大模型、Agentic AI、运筹优化、飞行控制及软硬件开发相关岗位正式员工、实习生、访问学者等,特别是面向无人系统(无人机、无人车、机器人等)的虚实融合Agentic AI训练和推理方向,有意者可邮件联系。
招生专业
081101-控制理论与控制工程
招生方向
群体智能,无人系统,博弈决策
专利与奖励
奖励信息
(1) 河北省科技进步二等奖, 二等奖, 省级, 2025(2) 山东电子学会科技进步一等奖, 一等奖, 市地级, 2025
专利成果
( 1 ) 无人机三维路径规划方法、装置、电子设备和存储介质, 发明专利, 2022, 第 1 作者, 专利号: CN115016546A( 2 ) 基于多个飞行器的协同制导方法、装置和电子设备, 发明专利, 2022, 第 1 作者, 专利号: CN115016544A( 3 ) 多无人机分布式编队控制方法、装置及电子设备, 发明专利, 2022, 第 1 作者, 专利号: CN114995521A( 4 ) 多智能体分布式协调控制方法、装置、设备和存储介质, 发明专利, 2022, 第 1 作者, 专利号: CN114967476A( 5 ) 无人机空中基站部署方法、装置及电子设备, 发明专利, 2022, 第 1 作者, 专利号: CN114845316A( 6 ) 目标监视方法、装置、电子设备及存储介质, 发明专利, 2022, 第 1 作者, 专利号: CN114840028A( 7 ) 一种驾束制导体制下多弹协同高精度制导控制方法, 发明专利, 2017, 第 2 作者, 专利号: CN107179021A( 8 ) 无人机机翼同步折叠展开机构, 发明专利, 2016, 第 5 作者, 专利号: CN105799915A( 9 ) 飞轮式高速无人机弹射器, 发明专利, 2016, 第 5 作者, 专利号: CN105799948A( 10 ) 一种单滑块变质心控制飞行器的动态稳定性判定方法, 发明专利, 2014, 第 5 作者, 专利号: CN104166348A
出版信息
发表论文
(1) OMoE: Diversifying Mixture of Low-Rank Adaptation by Orthogonal Finetuning, The 28th European Conference on Artificial Intelligence, 2025, 第 5 作者(2) Vision-Based Generic Potential Function for Policy Alignment in Multi-Agent Reinforcement Learning, AAAI 2025, 2025, 第 5 作者(3) Co-Opetition Network-Based Group Decision-Making Under Incomplete Information, IEEE TRANSACTIONS ON SYSTEMS MAN CYBERNETICS-SYSTEMS, 2025, 第 4 作者(4) Hybrid Actor-Critic for Physically Heterogeneous Multi-Agent Reinforcement Learning, IEEE Transactions on Cognitive and Developmental Systems, 2025, 第 3 作者(5) Self-Clustering Hierarchical Multi-Agent Reinforcement Learning With Extensible Cooperation Graph, IEEE TRANSACTIONS ON EMERGING TOPICS IN COMPUTATIONAL INTELLIGENCE, 2025, 第 5 作者(6) Neural Formation A*: A Knowledge-Data Hybrid-Driven Path Planning Algorithm for Multi-agent Formation Cooperation, ICANN, 2024, 第 2 作者(7) An Affine-based Maneuver Control Method for Multi-agent Cooperative Transportation System over Switching Formations, IEEE International Conference on System, Man, and Cybernetics (SMC), 2024, 第 2 作者(8) Heterogeneous Observation Aggregation Network for Multi-agent Reinforcement Learning, IJCNN, 2024, 第 2 作者(9) Measuring Policy Distance for Multi-Agent Reinforcement Learning, International Joint Conference on Autonomous Agents and Multi-agent Systems (AAMAS), 2024, 第 3 作者(10) Coevolving with the Other You: Fine-Tuning LLM with Sequential Cooperative Multi-Agent Reinforcement Learning, NeurIPS, 2024, 第 5 作者(11) A Policy Resonance Approach to Solve the Problem of Responsibility Diffusion in Multiagent Reinforcement Learning, IEEE TRANSACTIONS ON NEURAL NETWORKS AND LEARNING SYSTEMS, 2024, 第 5 作者(12) Learning Cooperative Policies with Graph Networks in Distributed Swarm Systems, 2023 International Joint Conference on Neural Networks (IJCNN2023), 2023, 第 5 作者(13) A Deep Reinforcement Learning Approach Combined With Model-Based Paradigms for Multiagent Formation Control With Collision Avoidance, IEEE TRANSACTIONS ON SYSTEMS MAN CYBERNETICS-SYSTEMS, 2023, 第 3 作者(14) Learning superior cooperative policy in adversarial multi-team reinforcement learning, 2023 International Joint Conference on Neural Networks (IJCNN2023), 2023, 第 5 作者(15) Learning Heterogeneous Agent Cooperation via Multiagent League Training, IFAC PAPERSONLINE, 2023, 第 2 作者(16) 3D deployment of UAV-mounted base stations for heterogeneous access requirements, AEROSPACE SCIENCE AND TECHNOLOGY, 2023, 第 1 作者(17) Velocity and input constrained distributed nash equilibrium seeking for multi-agent integrated game and control via event-triggered communication, Nonlinear Dynamics, 2022, 第 2 作者 通讯作者(18) Distributed coordinated tracking control for multi-manipulator systems under intermittent communications, NONLINEAR DYNAMICS, 2022, 第 4 作者(19) Fixed-time consensus disturbance rejection for high-order nonlinear multi-agent systems with input saturation, TRANSACTIONS OF THE INSTITUTE OF MEASUREMENT AND CONTROL, 2022, 第 1 作者 通讯作者(20) Observer-based consensus control for heterogeneous multi-agent systems with intermittent communications, INTERNATIONAL JOURNAL OF ROBUST AND NONLINEAR CONTROL, 2021, 第 4 作者(21) Distributed Nash equilibrium seeking for integrated game and control of multi-agent systems with input delay, NONLINEAR DYNAMICS, 2021, 第 1 作者 通讯作者(22) Distributed adaptive Nash equilibrium seeking and disturbance rejection for noncooperative games of high-order nonlinear systems with input saturation and input delay, INTERNATIONAL JOURNAL OF ROBUST AND NONLINEAR CONTROL, 2021, 第 1 作者 通讯作者(23) Distributed fixed-time event-triggered consensus of linear multi-agent systems with input delay, INTERNATIONAL JOURNAL OF ROBUST AND NONLINEAR CONTROL, 2021, 第 1 作者 通讯作者(24) Adaptive robust bipartite consensus of high-order uncertain multi-agent systems over cooperation-competition networks, JOURNAL OF THE FRANKLIN INSTITUTE-ENGINEERING AND APPLIED MATHEMATICS, 2020, 第 1 作者 通讯作者(25) Distributed Nash equilibrium seeking for networked games of multiple high-order systems with disturbance rejection and communication delay, NONLINEAR DYNAMICS, 2020, 第 1 作者 通讯作者(26) Fixed-time trajectory tracking for a quadrotor with external disturbances: A flatness-based sliding mode control approach, AEROSPACE SCIENCE AND TECHNOLOGY, 2019, 第 1 作者 通讯作者(27) Flatness-based finite-time leader–follower formation control of multiple quadrotors with external disturbances, AEROSPACE SCIENCE AND TECHNOLOGY, 2019, 第 1 作者 通讯作者(28) 基于积分反步法的四旋翼滑模轨迹跟踪算法, Integral backstepping based sliding mode trajectory tracking algorithm for quadrotor, 系统工程与电子技术, 2019, 第 2 作者(29) Autonomous Navigation and Nonlinear Control for Quadrotors in a Structured Environment, JOURNAL OF AEROSPACE ENGINEERING, 2019, 第 1 作者(30) Adaptive integrated guidance and control for impact angle constrained interception with actuator saturation, AERONAUTICAL JOURNAL, 2019, (31) Field-of-view constrained two-stage guidance law design for three-dimensional salvo attack of multiple missiles via an optimal control approach, AEROSPACE SCIENCE AND TECHNOLOGY, 2019, 第 1 作者(32) Co-operative 3D salvo attack of multiple missiles under switching topologies subject to time-varying communication delays, AERONAUTICAL JOURNAL, 2019, (33) Distributed adaptive neural networks leader-following formation control for quadrotors with directed switching topologies, ISA TRANSACTIONS, 2019, 第 4 作者(34) 基于模型参考自适应的天线罩误差斜率估计, Estimation of Radome Boresight Error Slope Based on Model Reference Adaptive System, 弹箭与制导学报, 2018, 第 3 作者(35) Cooperative multiple task assignment problem with stochastic velocities and time windows for heterogeneous unmanned aerial vehicles using a genetic algorithm, AEROSPACE SCIENCE AND TECHNOLOGY, 2018, 第 3 作者(36) Disturbance observer-based consensus tracking for nonlinear multiagent systems with switching topologies, INTERNATIONAL JOURNAL OF ROBUST AND NONLINEAR CONTROL, 2018, 第 1 作者(37) Observer-based adaptive sliding mode backstepping output-feedback DSC for spin-stabilized canard-controlled projectiles, CHINESE JOURNAL OF AERONAUTICS, 2017, 第 4 作者(38) Adaptive robust consensus tracking for nonlinear second-order multi-agent systems with heterogeneous uncertainties, INTERNATIONAL JOURNAL OF ROBUST AND NONLINEAR CONTROL, 2017, 第 1 作者(39) Integral backstepping sliding mode control for quadrotor helicopter under external uncertain disturbances, AEROSPACE SCIENCE AND TECHNOLOGY, 2017, 第 6 作者(40) A modified two-part wolf pack search algorithm for the multiple traveling salesmen problem, APPLIED SOFT COMPUTING JOURNAL, 2017, 第 3 作者(41) Optimal formation control with limited communication for multi-unmanned aerial vehicle in an obstacle-laden environment, PROCEEDINGS OF THE INSTITUTION OF MECHANICAL ENGINEERS PART G-JOURNAL OF AEROSPACE ENGINEERING, 2017, 第 1 作者(42) Trajectory optimization of multiple quad-rotor UAVs in collaborative assembling task, CHINESE JOURNAL OF AERONAUTICS, 2016, 第 5 作者
发表著作
(1) 基于多智能体强化学习的群体智能理论与方法, 国防工业出版社, 2026-10, 第 2 作者
科研活动
科研项目
( 1 ) 某融合控制系统, 负责人, 中国科学院计划, 2026-01--2027-12( 2 ) 某蜂群反制系统, 负责人, 国家任务, 2026-01--2026-12( 3 ) 基于语义调节器的人-无人集群混合决策与控制方法研究, 负责人, 国家任务, 2026-01--2028-12( 4 ) 空中XXXX决策技术, 负责人, 国家任务, 2025-11--2027-10( 5 ) 某探针AI模型建立, 负责人, 中国科学院计划, 2025-01--2026-12( 6 ) 具有自进化能力的多智能体任务协同技术及验证, 负责人, 境内委托项目, 2023-06--2024-06( 7 ) 资源分配多智能体强化学习模型开发, 负责人, 境内委托项目, 2023-01--2023-12( 8 ) 基于数据知识联合驱动的多智能体任务协同研究, 负责人, 境内委托项目, 2022-06--2023-06