基本信息

陈莉  女  硕导  中国科学院计算技术研究所
电子邮件: lchen@ict.ac.cn
通信地址: 北京海淀区科学院南路6号计算所编译组
邮政编码: 100190

研究领域

 HPC和AI领域的并行编程语言,编译技术

目前的研究重点

面向大模型算子和国产芯片的领域编程语言和编译优化技术

招生信息

   
招生专业
081201-计算机系统结构
招生方向
并行编译;并行编程语言

工作经历

1995/7 ——1999/8 山东科技大学, 应用数学与软件工程系, 助教/讲师

2002/7 ——2005-11 中国科学院计算技术研究所 助理研究员

2005/11——今 中国科学院技术技术研究所 副研究员

专利与奖励

   
专利成果
( 1 ) 一种基于即时规约的混合精度误差分析方法及其系统, 发明专利, 2025, 第 2 作者, 专利号: 2025104895358

( 2 ) 一种利用数据拓扑信息的优先级分组调度方法及系统, 发明授权, 2019, 第 1 作者, 专利号: CN105528243B

( 3 ) 一种利用数据拓扑信息的优先级分组调度方法及系统, 发明专利, 2016, 第 1 作者, 专利号: CN105528243A

( 4 ) 基于消息传递接口的设备的通信行为信息提取方法及系统, 发明专利, 2011, 第 3 作者, 专利号: CN101571814B

( 5 ) 基于消息传递接口的设备的通信行为信息提取方法及系统, 发明专利, 2009, 第 3 作者, 专利号: CN101571814A

出版信息

   
发表论文
(1) Scalable tasking runtime with parallelized builders for explicit message passing architectures, PARALLEL COMPUTING, 2025, 第 2 作者  通讯作者
(2) Improving Scalability of Sequential Task Flow Models with Cache-Friendly Parallel Dependency Tracking, CCF Transactions on High Performance Computing, 2025, 第 2 作者  通讯作者
(3) SW39000处理器上顺序任务流多从核辅助并行构图算法, 计算机研究与发展, 2025, 第 3 作者
(4) Light-FP: Analyze Floating-Point Error in a Highly Condensed Approach, 39th ACM International Conference on Supercomputing, 2025, 第 2 作者  通讯作者
(5) 新一代神威处理器上高效任务流并行系统, 计算机科学, 2024, 第 4 作者  通讯作者
(6) Smart Scheduler: an Adaptive NVM-Aware Thread Scheduling Approach on NUMA Systems, CCF Transactions on High Performance Computing (THPC), 2022, 第 3 作者
(7) Many-core acceleration of the first-principles all-electron quantum perturbation calculations, COMPUTER PHYSICS COMMUNICATIONS, 2021, 第 11 作者
(8) AceMesh: A Structured Data Driven Programming Language for High Performance Computing, CCF Transactions on High Performance Computing, 2020, 第 1 作者  通讯作者
(9) “神威·太湖之光”上Tend_lin应用的并行优化研究, Parallel optimization of Tend_lin application on the Sunway TaihuLight supercomputer, 计算机工程与科学, 2020, 第 5 作者  通讯作者
(10) Monitoring Memory Behaviors and Mitigating NUMA Drawbacks on Tiered NVM Systems, The 17th IFIP Intl. Conf. on Network and Par. Computing, 2020, 第 6 作者
(11) 用数据驱动的编程模型并行多重网格应用, Parallelizing Multigrid Application Using Data-driven Programming Model, 计算机科学, 2020, 第 3 作者  通讯作者
(12) 一个面向任务图并行程序的错误检查工具, Error Checking Tool for DAG-based Task Parallel Programs, 计算机科学, 2017, 第 1 作者  通讯作者
(13) 异构并行编程模型研究与进展, Research on Heterogeneous Parallel Programming Model, 软件学报, 2014, 第 4 作者
(14) 基于进程投机并行的运行时系统设计与优化, Design and Optimization on Runtime System of Process-based Speculative Parallelization, 计算机工程, 2014, 第 3 作者
(15) 支持算法组件自动替换的编程范式及编译框架, A programming paradigm and compiler framework for automatic replacement of algorithm components, 高技术通讯, 2013, 第 3 作者
(16) 任务并行编程模型研究与进展, Research on Task Parallel Programming Model, 软件学报, 2013, 第 3 作者
(17) A compiler-assisted runtime-prefetching scheme for heterogeneous platforms, Proceedings of the 8th International Workshop on OpenMP, 2012, 第 1 作者  通讯作者
(18) Shared work list: hacking amorphous data parallelism in UPC, 2012 International Workshop on Programming Models and Applications for Multicores and Manycores (in conjunction with PPoPP2012), 2012, 第 2 作者  通讯作者
(19) Unified Parallel C for GPU Clusters: Language Extensions and Compiler Implementation, LANGUAGES AND COMPILERS FOR PARALLEL COMPUTING, 2011, 第 1 作者  通讯作者
(20) PADS: A Pattern-Driven Stencil Compiler-Based Tool for Reuse of Optimizations on GPGPUs, 2011 IEEE 17TH INTERNATIONAL CONFERENCE ON PARALLEL AND DISTRIBUTED SYSTEMS (ICPADS), 2011, 第 3 作者  通讯作者
(21) Computation Pattern Driven Reuse of Mannul Optimizations for GPGPUs, 12THINTERNATIONALCONFERENCEONPARALLELANDDISTRIBUTEDCOMPUTINGAPPLICATIONSANDTECHNOLOGIES, 2011, 第 3 作者  通讯作者
(22) 带类型恢复的编译器源源翻译技术, A Source-to-Source Translation Method with Type Restoration in a Compiler, 计算机研究与发展, 2010, 第 3 作者
(23) 面向非多媒体程序的SIMD向量化算法的研究及改进, Research and Improvement of SIMD Vecotrization Algorithms on Non-multimedia Applications, 小型微型计算机系统, 2009, 第 3 作者
(24) POM:一个MPI程序的进程优化映射工具, POM.A Process Optimization Mapping Tool for MPI Programs, 计算机工程与科学, 2009, 第 3 作者
(25) PARBLO: Page-Allocation-Based DRAM Row Buffer Locality Optimization, PARBLO: Page-Allocation-Based DRAM Row Buffer Locality Optimization, Journal of Computer Science and Technology, 2009, 第 4 作者
(26) 面向向量化的局部数据重组, Vectorization-oriented Local Data Regrouping, 小型微型计算机系统, 2009, 第 3 作者
(27) Global loop tiling for distributed memory systems, Euro-Par, 2008, 第 2 作者
(28) Global tiling for communication minimal parallelization on distributed memory systems, EURO-PAR 2008 PARALLEL PROCESSING, PROCEEDINGS, 2008, 第 2 作者
(29) Automatic Implementation of Multi-partitioning Using Global Tiling, 14th IEEE International Conference on Parallel and Distributed Systems, 2008, 第 4 作者
(30) 全局部分重复计算划分, 计算机研究与发展, 2006, 第 2 作者
(31) Integrating Parallelizing Compilation Technologies for SMP Clusters, Integrating Parallelizing Compilation Technologies for SMP Clusters, Journal of Computer Science and Technology, 2005, 第 2 作者
(32) 基于动态profiling技术的流水粒度调优, Tuning Pipeline Granularity Based on Dynamic Profiling Framework, 计算机研究与发展, 2005, 第 2 作者
(33) Global Partial Replicate Computation Partitioning, International Conference on Parallel Processing, 2004, 第 2 作者
(34) 分布存储系统中优化通信的冗余计算分割, Redundant Computation Partitioning in Distributed-Memory Systems, 计算机学报, 2003, 第 1 作者
(35) 分布内存系统中节点间软流水优化技术, Exploiting Inter-node Pipelining Parallelism in Distributed Memory Systems, 计算机科学, 2002, 第 1 作者

合作情况

   
项目协作单位

1.Intel Corp., Scalable Execution Environment of Heterogeneous Multi-/Many-core(多核/众核的异构平台上的可扩展执行环境)
2.University of Houston, on "Data oriented extensions to shared memory programming model for hetergeneous Many-core systems (异构平台上以数据为中心的多线程编程模型扩展)."