基本信息
陈莉 女 硕导 中国科学院计算技术研究所
电子邮件: lchen@ict.ac.cn
通信地址: 北京海淀区科学院南路6号计算所编译组
邮政编码: 100190
研究领域
HPC和AI领域的并行编程语言,编译技术
目前的研究重点
面向大模型算子和国产芯片的领域编程语言和编译优化技术
招生信息
招生专业
081201-计算机系统结构
招生方向
并行编译;并行编程语言
工作经历
1995/7 ——1999/8 山东科技大学, 应用数学与软件工程系, 助教/讲师
2002/7 ——2005-11 中国科学院计算技术研究所 助理研究员
2005/11——今 中国科学院技术技术研究所 副研究员
专利与奖励
专利成果
( 1 ) 一种基于即时规约的混合精度误差分析方法及其系统, 发明专利, 2025, 第 2 作者, 专利号: 2025104895358( 2 ) 一种利用数据拓扑信息的优先级分组调度方法及系统, 发明授权, 2019, 第 1 作者, 专利号: CN105528243B( 3 ) 一种利用数据拓扑信息的优先级分组调度方法及系统, 发明专利, 2016, 第 1 作者, 专利号: CN105528243A( 4 ) 基于消息传递接口的设备的通信行为信息提取方法及系统, 发明专利, 2011, 第 3 作者, 专利号: CN101571814B( 5 ) 基于消息传递接口的设备的通信行为信息提取方法及系统, 发明专利, 2009, 第 3 作者, 专利号: CN101571814A
出版信息
发表论文
(1) Scalable tasking runtime with parallelized builders for explicit message passing architectures, PARALLEL COMPUTING, 2025, 第 2 作者 通讯作者(2) Improving Scalability of Sequential Task Flow Models with Cache-Friendly Parallel Dependency Tracking, CCF Transactions on High Performance Computing, 2025, 第 2 作者 通讯作者(3) SW39000处理器上顺序任务流多从核辅助并行构图算法, 计算机研究与发展, 2025, 第 3 作者(4) Light-FP: Analyze Floating-Point Error in a Highly Condensed Approach, 39th ACM International Conference on Supercomputing, 2025, 第 2 作者 通讯作者(5) 新一代神威处理器上高效任务流并行系统, 计算机科学, 2024, 第 4 作者 通讯作者(6) Smart Scheduler: an Adaptive NVM-Aware Thread Scheduling Approach on NUMA Systems, CCF Transactions on High Performance Computing (THPC), 2022, 第 3 作者(7) Many-core acceleration of the first-principles all-electron quantum perturbation calculations, COMPUTER PHYSICS COMMUNICATIONS, 2021, 第 11 作者(8) AceMesh: A Structured Data Driven Programming Language for High Performance Computing, CCF Transactions on High Performance Computing, 2020, 第 1 作者 通讯作者(9) “神威·太湖之光”上Tend_lin应用的并行优化研究, Parallel optimization of Tend_lin application on the Sunway TaihuLight supercomputer, 计算机工程与科学, 2020, 第 5 作者 通讯作者(10) Monitoring Memory Behaviors and Mitigating NUMA Drawbacks on Tiered NVM Systems, The 17th IFIP Intl. Conf. on Network and Par. Computing, 2020, 第 6 作者(11) 用数据驱动的编程模型并行多重网格应用, Parallelizing Multigrid Application Using Data-driven Programming Model, 计算机科学, 2020, 第 3 作者 通讯作者(12) 一个面向任务图并行程序的错误检查工具, Error Checking Tool for DAG-based Task Parallel Programs, 计算机科学, 2017, 第 1 作者 通讯作者(13) 异构并行编程模型研究与进展, Research on Heterogeneous Parallel Programming Model, 软件学报, 2014, 第 4 作者(14) 基于进程投机并行的运行时系统设计与优化, Design and Optimization on Runtime System of Process-based Speculative Parallelization, 计算机工程, 2014, 第 3 作者(15) 支持算法组件自动替换的编程范式及编译框架, A programming paradigm and compiler framework for automatic replacement of algorithm components, 高技术通讯, 2013, 第 3 作者(16) 任务并行编程模型研究与进展, Research on Task Parallel Programming Model, 软件学报, 2013, 第 3 作者(17) A compiler-assisted runtime-prefetching scheme for heterogeneous platforms, Proceedings of the 8th International Workshop on OpenMP, 2012, 第 1 作者 通讯作者(18) Shared work list: hacking amorphous data parallelism in UPC, 2012 International Workshop on Programming Models and Applications for Multicores and Manycores (in conjunction with PPoPP2012), 2012, 第 2 作者 通讯作者(19) Unified Parallel C for GPU Clusters: Language Extensions and Compiler Implementation, LANGUAGES AND COMPILERS FOR PARALLEL COMPUTING, 2011, 第 1 作者 通讯作者(20) PADS: A Pattern-Driven Stencil Compiler-Based Tool for Reuse of Optimizations on GPGPUs, 2011 IEEE 17TH INTERNATIONAL CONFERENCE ON PARALLEL AND DISTRIBUTED SYSTEMS (ICPADS), 2011, 第 3 作者 通讯作者(21) Computation Pattern Driven Reuse of Mannul Optimizations for GPGPUs, 12THINTERNATIONALCONFERENCEONPARALLELANDDISTRIBUTEDCOMPUTINGAPPLICATIONSANDTECHNOLOGIES, 2011, 第 3 作者 通讯作者(22) 带类型恢复的编译器源源翻译技术, A Source-to-Source Translation Method with Type Restoration in a Compiler, 计算机研究与发展, 2010, 第 3 作者(23) 面向非多媒体程序的SIMD向量化算法的研究及改进, Research and Improvement of SIMD Vecotrization Algorithms on Non-multimedia Applications, 小型微型计算机系统, 2009, 第 3 作者(24) POM:一个MPI程序的进程优化映射工具, POM.A Process Optimization Mapping Tool for MPI Programs, 计算机工程与科学, 2009, 第 3 作者(25) PARBLO: Page-Allocation-Based DRAM Row Buffer Locality Optimization, PARBLO: Page-Allocation-Based DRAM Row Buffer Locality Optimization, Journal of Computer Science and Technology, 2009, 第 4 作者(26) 面向向量化的局部数据重组, Vectorization-oriented Local Data Regrouping, 小型微型计算机系统, 2009, 第 3 作者(27) Global loop tiling for distributed memory systems, Euro-Par, 2008, 第 2 作者(28) Global tiling for communication minimal parallelization on distributed memory systems, EURO-PAR 2008 PARALLEL PROCESSING, PROCEEDINGS, 2008, 第 2 作者(29) Automatic Implementation of Multi-partitioning Using Global Tiling, 14th IEEE International Conference on Parallel and Distributed Systems, 2008, 第 4 作者(30) 全局部分重复计算划分, 计算机研究与发展, 2006, 第 2 作者(31) Integrating Parallelizing Compilation Technologies for SMP Clusters, Integrating Parallelizing Compilation Technologies for SMP Clusters, Journal of Computer Science and Technology, 2005, 第 2 作者(32) 基于动态profiling技术的流水粒度调优, Tuning Pipeline Granularity Based on Dynamic Profiling Framework, 计算机研究与发展, 2005, 第 2 作者(33) Global Partial Replicate Computation Partitioning, International Conference on Parallel Processing, 2004, 第 2 作者(34) 分布存储系统中优化通信的冗余计算分割, Redundant Computation Partitioning in Distributed-Memory Systems, 计算机学报, 2003, 第 1 作者(35) 分布内存系统中节点间软流水优化技术, Exploiting Inter-node Pipelining Parallelism in Distributed Memory Systems, 计算机科学, 2002, 第 1 作者
合作情况
项目协作单位
1.Intel Corp., Scalable Execution Environment of Heterogeneous Multi-/Many-core(多核/众核的异构平台上的可扩展执行环境)
2.University of Houston, on "Data oriented extensions to shared memory programming model for hetergeneous Many-core systems (异构平台上以数据为中心的多线程编程模型扩展)."