基本信息
彭少辉      中国科学院软件研究所
电子邮件: pengshaohui@iscas.ac.cn
通信地址: 北京市海淀区中关村南四街4号
邮政编码:

教育背景

2018-09--2023-06   中国科学院计算技术研究所   博士
2014-09--2018-07   中国科学院大学   本科

工作经历

   
工作简历
2025-10~现在, 中国科学院软件研究所, 副研究员
2023-07~2025-10,中国科学院软件研究所, 助理研究员

专利与奖励

   
专利成果
( 1 ) 基于上下文符号策略的元强化学习自动控制方法及系统, 发明专利, 2024, 第 3 作者, 专利号: CN117991628A

( 2 ) 一种多任务强化学习方法及系统, 发明专利, 2024, 第 4 作者, 专利号: CN117829250A

( 3 ) 一种离线元强化学习的上下文分布偏移缓解方法及系统, 发明专利, 2024, 第 6 作者, 专利号: CN117725983A

( 4 ) 一种基于对象的强化学习方法及系统, 发明专利, 2024, 第 3 作者, 专利号: CN117689912A

( 5 ) 一种捕捉环境中可控因素的表示学习方法及系统, 发明专利, 2024, 第 3 作者, 专利号: CN117688983A

( 6 ) 因果关系驱动的分层强化学习框架及分层强化学习方法, 发明专利, 2022, 第 2 作者, 专利号: CN115271090A

出版信息

   
发表论文
(1) QiMeng-Attention: SOTA Attention Operator is generated by SOTA Attention Algorithm, ACL 2025, 2025, 第 2 作者
(2) QiMeng-TensorOp: One-Line Prompt is Enough for High-Performance Tensor Operator Generation with Hardware Primitives, Thirty-Fourth International Joint Conference on Artificial Intelligence (IJCAI-25), 2025, 第 2 作者
(3) Morphology Generalizable Reinforcement Learning via Multi-level Graph Features, Neurocomputing, 2025, 第 4 作者
(4) SEEN-DA: SEmantic ENtropy guided Domain-aware Attention for Domain Adaptive Object Detection, CVPR, 2025, 第 7 作者
(5) OCEAN-MBRL: Offline Conservative Exploration for Model-Based Offline Reinforcement Learning, AAAI Conference on Artificial Intelligence (AAAI), 2024, 第 6 作者
(6) 基于语言类任务的概念化强化学习框架, Conceptual reinforcement learning for language-assisted tasks, 高技术通讯, 2024, 第 1 作者
(7) Efficient Symbolic Policy Learning with Differentiable Symbolic Expression, ADVANCES IN NEURAL INFORMATION PROCESSING SYSTEMS 36 (NEURIPS 2023), 2023, 第 3 作者
(8) Learning controllable elements oriented representations for reinforcement learning, NEUROCOMPUTING, 2023, 第 3 作者
(9) Conceptual Reinforcement Learning for Language-Conditioned Tasks, AAAI Conference on Artificial Intelligence (AAAI), 2023, 第 1 作者
(10) Decompose a Task into Generalizable Subtasks in Multi-Agent Reinforcement Learning, ADVANCES IN NEURAL INFORMATION PROCESSING SYSTEMS 36 (NEURIPS 2023), 2023, 第 7 作者
(11) Tetris: A Heuristic Static Memory Management Framework for Uniform Memory Multicore Neural Network Accelerators, Tetris: A Heuristic Static Memory Management Framework for Uniform Memory Multicore Neural Network Accelerators, Journal of Computer Science and Technology, 2022, 第 3 作者
(12) Deep Fusion: A Software Scheduling Method for Memory Access Optimization, Network and Parallel Computing, 2019, 第 2 作者