基本信息
陈云霁 中国科学院计算技术研究所
电子邮件: cyj@ict.ac.cn
通信地址: 北京市海淀区科学院南路6号
邮政编码: 100190
电子邮件: cyj@ict.ac.cn
通信地址: 北京市海淀区科学院南路6号
邮政编码: 100190
招生信息
招生专业
081201-计算机系统结构
招生方向
芯片体系结构,机器学习
个人简历
2025-11--中国科学院工业人工智能研究所 副所长2024-01--2024-07 中国科学院科技基础能力局 副局长2022-05--处理器芯片全国重点实验室 主任2021-02--中国科学院计算技术研究所 副所长2007-07--中国科学院计算技术研究所 助研、副研、研究员2002-09--2007-07 中国科学院计算技术研究所 博士生1997-09--2002-07 中国科学技术大学 本科生
教授课程
智能计算系统本科生毕业设计(计算机科学与技术)智能计算机基础及应用数字电路并行系统
出版信息
发表论文
(1) Automated Superscalar Processor Design by Learning Data Dependencies, IJCAI-2025, 2025, 第 13 作者 通讯作者(2) QiMeng-Attention: SOTA Attention Operator is generated by SOTA Attention Algorithm, ACL 2025, 2025, 第 13 作者(3) QiMeng-Xpiler: Transcompiling Tensor Programs for Deep Learning Systems with a Neural-Symbolic Approach, OSDI 2025, 2025, 第 14 作者(4) QiMeng-TensorOp: One-Line Prompt is Enough for High-Performance Tensor Operator Generation with Hardware Primitives, Thirty-Fourth International Joint Conference on Artificial Intelligence (IJCAI-25), 2025, 第 14 作者(5) QiMeng-GEMM: Automatically Generating High-Performance Matrix Multiplication Code by Exploiting Large Language Models, AAAI Conference on Artificial Intelligence (AAAI), 2025, 第 9 作者(6) Morphology Generalizable Reinforcement Learning via Multi-level Graph Features, Neurocomputing, 2025, 第 17 作者(7) AI Computing Systems for Large Language Models Training, Journal of Computer Science and Technology, 2024, 第 12 作者 通讯作者(8) InverseCoder: Self-improving Instruction-Tuned Code LLMs with Inverse-Instruct, AAAI 2025, 2024, 第 16 作者 通讯作者(9) OCEAN-MBRL: Offline Conservative Exploration for Model-Based Offline Reinforcement Learning, AAAI Conference on Artificial Intelligence (AAAI), 2024, 第 13 作者(10) Automated CPU Design by Learning from Input-Output Examples, IJCAI-24, 2024, 第 17 作者 通讯作者(11) Prompt-based Visual Alignment for Zero-shot Policy Transfer, ICML 2024, 2024, 第 16 作者 通讯作者(12) Emergent Communication for Numerical Concepts Generalization, AAAI-24, 2024, 第 16 作者 通讯作者(13) Introducing Compiler Semantics into Large Language Models as Programming Language Translators: A Case Study of C to x86 Assembly, EMNLP 2024, 2024, 第 5 作者(14) Hypothesis, Verification, and Induction: Grounding Large Language Models with Self-Driven Skill Learning, AAAI-24, 2024, 第 11 作者(15) Online Prototype Alignment for Few-shot Policy Transfer, International Conference on Minority Languages (ICML XVI), 2023, 第 2 作者 通讯作者(16) Conceptual Reinforcement Learning for Language-Conditioned Tasks, AAAI Conference on Artificial Intelligence (AAAI), 2023, 第 10 作者 通讯作者(17) BALTO: fast tensor program optimization with diversity-based active learning, ICLR 2023, 2023, 第 10 作者(18) Rescue to the Curse of universality, SCIENCE CHINA-INFORMATION SCIENCES, 2023, 第 5 作者 通讯作者(19) Online Symbolic Regression with Informative Query, AAAI Conference on Artificial Intelligence (AAAI), 2023, 第 2 作者 通讯作者(20) Learning controllable elements oriented representations for reinforcement learning, NEUROCOMPUTING, 2023, 第 10 作者(21) BabelTower: Learning to Auto-parallelized Program Translation, Proceedings of the 39 th International Conference on Machine Learning, 2022, 第 13 作者 通讯作者(22) Object-Category Aware Reinforcement Learning, NeurIPS 2022, 2022, 第 9 作者 通讯作者(23) Neural Program Synthesis with Query, ICLR 2022, 2022, 第 9 作者(24) Tetris: A Heuristic Static Memory Management Framework for Uniform Memory Multicore Neural Network Accelerators, Tetris: A Heuristic Static Memory Management Framework for Uniform Memory Multicore Neural Network Accelerators, Journal of Computer Science and Technology, 2022, 第 6 作者(25) Cambricon-G: A Polyvalent Energy-Efficient Accelerator for Dynamic Graph Neural Networks, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2022, 第 10 作者 通讯作者(26) Causality-driven Hierarchical Structure Discovery for Reinforcement Learning, NeurIPS 2022, 2022, 第 12 作者 通讯作者(27) Accelerating Sparse Convolution with Column Vector-Wise Sparsity, NeurIPS 2022, 2022, 第 6 作者(28) Breaking the interaction wall: A DLPU-centric deep learning computing system, IEEE Transactions on Computers, 2022, 第 9 作者 通讯作者(29) ScaleCert: Scalable Certified Defense against Adversarial Patches with Sparse Superficial Layers, 2021, 第 9 作者(30) Cambricon-G: A Polyvalent Energy-efficient Accelerator for Dynamic Graph Neural Networks, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2021, 第 10 作者 通讯作者(31) A Decomposable Winograd Method for N-D Convolution Acceleration in Video Analysis, INTERNATIONAL JOURNAL OF COMPUTER VISION, 2021, 第 9 作者(32) Distilling Object Detectors with Feature Richness, 2021, 第 7 作者(33) Space-address decoupled scratchpad memory management for neural network accelerators, CONCURRENCY AND COMPUTATION-PRACTICE & EXPERIENCE, 2021, 第 6 作者(34) Hindsight Value Function for Variance Reduction in Stochastic Dynamic Environment, 2021, 第 9 作者(35) 实现科技强国梦,青年科技工作者的使命但当, 科技导报, 2021, 第 1 作者(36) ALT : Optimizing Tensor Compilation in Deep Learning Compilers with Active Learning, 2020 IEEE 38TH INTERNATIONAL CONFERENCE ON COMPUTER DESIGN (ICCD 2020), 2020, 第 6 作者(37) Fixed-Point Back-Propagation Training, 2020 IEEE/CVF CONFERENCE ON COMPUTER VISION AND PATTERN RECOGNITION (CVPR), 2020, 第 11 作者(38) QingLong:一种基于常变量异步拷贝的神经网络编程模型, QingLong:A Neural Network Programming Model Based on Asynchronous Copy of Constant and Variable, 计算机学报, 2020, 第 2 作者(39) Self-Aware Neural Network Systems: A Survey and New Perspective, PROCEEDINGS OF THE IEEE, 2020, 第 4 作者 通讯作者(40) Addressing Irregularity in Sparse Neural Networks Through a Cooperative Software/Hardware Approach, IEEE TRANSACTIONS ON COMPUTERS, 2020, 第 14 作者 通讯作者(41) 提升高性能计算程序性能可移植性的领域特定语言, Domain-specific language for improving the performance portability of high-performance computing programs, 高技术通讯, 2020, 第 4 作者(42) ParaML: A Polyvalent Multicore Accelerator for Machine Learning, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2020, 第 12 作者(43) Machine Learning Computers With Fractal von Neumann Architecture, IEEE TRANSACTIONS ON COMPUTERS, 2020, 第 10 作者(44) Cambricon-F: Machine Learning Computers with Fractal von Neumann Architecture, PROCEEDINGS OF THE 2019 46TH INTERNATIONAL SYMPOSIUM ON COMPUTER ARCHITECTURE (ISCA '19), 2019, 第 8 作者 通讯作者(45) TDSNN: From Deep Neural Networks to Deep Spike Neural Networks with Temporal-Coding, THIRTY-THIRD AAAI CONFERENCE ON ARTIFICIAL INTELLIGENCE / THIRTY-FIRST INNOVATIVE APPLICATIONS OF ARTIFICIAL INTELLIGENCE CONFERENCE / NINTH AAAI SYMPOSIUM ON EDUCATIONAL ADVANCES IN ARTIFICIAL INTELLIGENCE, 2019, 第 5 作者 通讯作者(46) An Instruction Set Architecture for Machine Learning, ACM TRANSACTIONS ON COMPUTER SYSTEMS, 2019, 第 1 作者(47) 低面积低功耗的机器学习运算单元设计, An area and power-efficient machine learning functional unit, 高技术通讯, 2019, 第 5 作者(48) BSHIFT: A Low Cost Deep Neural Networks Accelerator, INTERNATIONAL JOURNAL OF PARALLEL PROGRAMMING, 2019, 第 5 作者(49) Addressing Sparsity in Deep Neural Networks, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2019, 第 10 作者 通讯作者(50) 树立良好作风学风,是科研工作者的责任, Building a good tradition for research, 中国科学基金, 2019, 第 1 作者(51) Guest Editors' Introduction: Special Issue on Big Data Systems on Emerging Architectures, IEEE TRANSACTIONS ON BIG DATA, 2019, 第 2 作者(52) TDSNN:from DNN to deep SNN with temporal coding, AAAI Conference on Artificial Intelligence, 2019, 第 1 作者 通讯作者(53) 智能芯片的评述和展望, A Survey of Artificial Intelligence Chip, 计算机研究与发展, 2019, 第 4 作者(54) 稀疏神经网络加速器设计, An accelerator for sparse neural network, 高技术通讯, 2019, 第 3 作者(55) Addressing Sparisity in Deep Neural Networks, IEEE Trans. on CAD of Integrated Circuits and Systems, 2018, 第 1 作者(56) Cambricon-S: Addressing Irregularity in Sparse Neural Networks through A Cooperative Software/Hardware Approach, 2018 51ST ANNUAL IEEE/ACM INTERNATIONAL SYMPOSIUM ON MICROARCHITECTURE (MICRO), 2018, 第 10 作者 通讯作者(57) Using Local Clocks to Reproduce Concurrency Bugs, IEEE TRANSACTIONS ON SOFTWARE ENGINEERING (CCF A), 2018, 第 10 作者(58) 深度学习编程框架, Programming frameworks for deep learning algorithms, 大数据, 2018, 第 3 作者(59) 新时代“科学春天”众人谈, 中国科技奖励, 2018, 第 10 作者(60) BENCHIP: Benchmarking Intelligence Processors, BENCHIP: Benchmarking Intelligence Processors, Journal of Computer Science and Technology, 2018, 第 14 作者(61) TuNao: A High-Performance and Energy-Efficient Reconfigurable Accelerator for Graph Processing, 2017 17TH IEEE/ACM INTERNATIONAL SYMPOSIUM ON CLUSTER, CLOUD AND GRID COMPUTING (CCGRID), 2017, 第 9 作者(62) An Accelerator for High Efficient Vision Processing, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2017, 第 10 作者(63) DLPlib: A Library for Deep Learning Processor, DLPlib: A Library for Deep Learning Processor, Journal of Computer Science and Technology, 2017, 第 9 作者(64) Service-Oriented Architecture on FPGA-Based MPSoC, IEEE TRANSACTIONS ON PARALLEL AND DISTRIBUTED SYSTEMS, 2017, 第 3 作者(65) Secure Outsourcing of Virtual Appliance, IEEE TRANSACTIONS ON CLOUD COMPUTING, 2017, 第 4 作者(66) DaDianNao: A Neural Network Supercomputer, IEEE TRANSACTIONS ON COMPUTERS, 2017, 第 9 作者 通讯作者(67) 人工神经网络处理器, 中国科学: 生命科学, 2016, 第 1 作者(68) Accelerating Architectural Simulation Via Statistical Techniques: A Survey, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2016, 第 3 作者 通讯作者(69) DianNao Family: Energy-Efficient Hardware Accelerators for Machine Learning, COMMUNICATIONS OF THE ACM, 2016, 第 1 作者 通讯作者(70) 多媒体技术研究:2015——类脑计算的研究进展与发展趋势, Research on multimedia technology 2015——advances and trend of brain-like computing, 中国图象图形学报, 2016, 第 5 作者(71) A survey of routing algorithm for mesh Network-on-Chip, FRONTIERS OF COMPUTER SCIENCE, 2016, 第 3 作者 通讯作者(72) Near-Data Processing of Neural Networks, IEEE MICRO, 2016, 第 1 作者 通讯作者(73) Cambricon-X: An Accelerator for Sparse Neural Networks, 2016 49TH ANNUAL IEEE/ACM INTERNATIONAL SYMPOSIUM ON MICROARCHITECTURE (MICRO), 2016, 第 9 作者(74) Cambricon: An Instruction Set Architecture for Neural Networks, Computer Architecture (ISCA), 2016 ACM/IEEE 43rd Annual International Symposium on, 2016, 第 1 作者 通讯作者(75) 类脑计算芯片与类脑智能机器人发展现状与思考, Current Status and Consideration on Brain-like Computing Chip and Brain-like Intelligent Robot, 中国科学院院刊, 2016, 第 2 作者(76) IMR: High-Performance Low-Cost Multi-Ring NoCs, IEEE TRANSACTIONS ON PARALLEL AND DISTRIBUTED SYSTEMS, 2016, 第 8 作者 通讯作者(77) Deterministic Replay: A Survey, ACM COMPUTING SURVEYS, 2015, 第 1 作者(78) 数据触发的基本块间弹性控制电路综合方法, A method for elastic controller synthesis using data-triggered execution across basic blocks, 高技术通讯, 2015, 第 2 作者(79) 计算机系统模拟器研究综述, Survey on Computer System Simulator, 计算机研究与发展, 2015, 第 3 作者(80) PuDianNao: A Polyvalent Machine Learning Accelerator, ACM SIGPLAN NOTICES, 2015, 第 9 作者(81) Robust Design Space Modeling, ACM TRANSACTIONS ON DESIGN AUTOMATION OF ELECTRONIC SYSTEMS, 2015, 第 7 作者 通讯作者(82) Architecture Support for Task Out-of-Order Execution in MPSoCs, IEEE TRANSACTIONS ON COMPUTERS, 2015, 第 5 作者(83) Leveraging the Error Resilience of Neural Networks for Designing Highly Energy Efficient Accelerators, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2015, 第 3 作者(84) Robust Architectural Design Space Modeling, ACM Transactions on Design Automation of Electronic Systems, 2015, 第 7 作者 通讯作者(85) HERMES: A Fast Cross-ISA Binary Translator with Post-Optimization, 2015 IEEE/ACM INTERNATIONAL SYMPOSIUM ON CODE GENERATION AND OPTIMIZATION (CGO), 2015, 第 3 作者(86) ReCBuLC: Reproducing Concurrency Bugs Using Local Clocks, International Conference on Software Engineering, 2015, 第 1 作者(87) Statistical Performance Comparisons of Computers, IEEE TRANSACTIONS ON COMPUTERS, 2015, 第 7 作者(88) Neuromorphic Accelerators: A Comparison Between Neuroscience and Machine-Learning Approaches, PROCEEDINGS OF THE 48TH ANNUAL IEEE/ACM INTERNATIONAL SYMPOSIUM ON MICROARCHITECTURE (MICRO-48), 2015, 第 3 作者(89) Reproducing Concurrency Bugs Using Local Clocks, ACM/IEEE 37th International Conference on Software Engineering (ICSE 2015) (CCF A), 2015, 第 9 作者(90) ShiDianNao: Shifting Vision Processing Closer to the Sensor, 2015 ACM/IEEE 42ND ANNUAL INTERNATIONAL SYMPOSIUM ON COMPUTER ARCHITECTURE (ISCA), 2015, 第 8 作者(91) Retraining-Based Timing Error Mitigation for Hardware Neural Networks, 2015 DESIGN, AUTOMATION & TEST IN EUROPE CONFERENCE & EXHIBITION (DATE), 2015, 第 10 作者(92) FreeRider: Non-Local Adaptive Network-on-Chip Routing with Packet-Carried Propagation of Congestion Information, IEEE TRANSACTIONS ON PARALLEL AND DISTRIBUTED SYSTEMS, 2015, 第 9 作者(93) A Small-Footprint Accelerator for Large-Scale Neural Networks, ACM TRANSACTIONS ON COMPUTER SYSTEMS, 2015, 第 11 作者 通讯作者(94) Practical Iterative Optimization for the Data Center, ACM TRANSACTIONS ON ARCHITECTURE AND CODE OPTIMIZATION, 2015, 第 6 作者(95) Performance Portability Across Heterogeneous SoCs Using a Generalized Library-Based Approach, ACM TRANSACTIONS ON ARCHITECTURE AND CODE OPTIMIZATION, 2014, 第 9 作者(96) 二维Mesh结构的片上网络中利用全局信息的路由算法, A Novel Routing Algorithm for 2D Mesh Network-on-Chip Leveraging Global Information, 计算机辅助设计与图形学学报, 2014, 第 2 作者(97) 基于二进制插桩的共享指令集异构多核处理器进程迁移方法, A binary-instrumentation based execution migration method for shared ISA heterogeneous multi-core processors, 高技术通讯, 2014, 第 4 作者(98) An Elastic Architecture Adaptable to Various Application Scenarios, An Elastic Architecture Adaptable to Various Application Scenarios, Journal of Computer Science and Technology, 2014, 第 2 作者(99) 基于可行序的数据竞争检测, Data race detection via feasibleahead relation, 高技术通讯, 2014, 第 2 作者(100) Pre-Silicon Bug Forecast, IEEE TRANSACTIONS ON COMPUTER-AIDED DESIGN OF INTEGRATED CIRCUITS AND SYSTEMS, 2014, 第 3 作者(101) Auxiliary stream for optimizing memory access of video decoders, SCIENCE CHINA-INFORMATION SCIENCES, 2014, 第 3 作者(102) DaDianNao: A Machine-Learning Supercomputer, 2014 47TH ANNUAL IEEE/ACM INTERNATIONAL SYMPOSIUM ON MICROARCHITECTURE (MICRO), 2014, 第 1 作者 通讯作者(103) An 8-Core MIPS-Compatible Processor in 32/28 nm Bulk CMOS, IEEE JOURNAL OF SOLID-STATE CIRCUITS, 2014, 第 5 作者(104) Auxiliary stream for optimizing memory access of video decoders, SCIENCE CHINA Information Sciences, 2014, 第 3 作者(105) 面向低能耗的非精确异构多核上的运行时技术, Run-time technology for low-power oriented inexact heterogeneous multi-core, 高技术通讯, 2014, 第 6 作者(106) Prevention from Soft Errors via Architecture Elasticity, Prevention from Soft Errors via Architecture Elasticity, Journal of Computer Science and Technology, 2014, 第 2 作者(107) A General-Purpose Many-Accelerator Architecture Based on Dataflow Graph Clustering of Applications, A General-Purpose Many-Accelerator Architecture Based on Dataflow Graph Clustering of Applications, Journal of Computer Science and Technology, 2014, 第 4 作者(108) DianNao: A Small-Footprint High-Throughput Accelerator for Ubiquitous Machine-Learning, ACM SIGPLAN NOTICES, 2014, 第 6 作者(109) Effective and Efficient Microprocessor Design Space Exploration Using Unlabeled Design Configurations, ACM TRANSACTIONS ON INTELLIGENT SYSTEMS AND TECHNOLOGY, 2013, 第 2 作者(110) LDet: Determinizing Asynchronous Transfer for Postsilicon Debugging, IEEE TRANSACTIONS ON COMPUTERS, 2013, 第 1 作者 通讯作者(111) Motion Estimation Without Integer-Pel Search, IEEE TRANSACTIONS ON IMAGE PROCESSING, 2013, 第 3 作者(112) Deterministic Replay Using Global Clock, ACM TRANSACTIONS ON ARCHITECTURE AND CODE OPTIMIZATION, 2013, 第 1 作者(113) Microarchitectural design space exploration made fast, MICROPROCESSORS AND MICROSYSTEMS, 2013, 第 3 作者(114) 超大规模集成电路可调试性设计综述, Survey of Design-for-Debug of VLSI, 计算机研究与发展, 2012, 第 4 作者(115) Linear Time Memory Consistency Verification, IEEE TRANSACTIONS ON COMPUTERS, 2012, 第 2 作者(116) 一种用于通用处理器结构优化的矩阵乘法性能模型, Matrix Multiplication Performance Model for Optimizing General-purpose Processor Architecture, 小型微型计算机系统, 2012, 第 3 作者(117) Program Regularization in Memory Consistency Verification, IEEE TRANSACTIONS ON PARALLEL AND DISTRIBUTED SYSTEMS, 2012, 第 1 作者 通讯作者(118) 基于模型树的多核设计空间探索技术, Model Tree Based Multi-core Design Space Exploration, 计算机辅助设计与图形学学报, 2012, 第 3 作者(119) 多核处理器片上网络trace压缩方法, A NOC trace compression method for multi-core processors, 高技术通讯, 2011, 第 3 作者(120) 基于向量扩展多核处理器的矩阵乘法算法优化研究, Optimization of matrix multiplication based on a multi-core architecture extended with vector units, 中国科学技术大学学报, 2011, 第 2 作者(121) 一种面向多核处理器的通用可调试性架构, A General DFD Infrastructure for Chip Multiprocessor, 计算机辅助设计与图形学学报, 2011, 第 6 作者(122) System Architecture of Godson-3 Multi-Core Processors, System Architecture of Godson-3 Multi-Core Processors, Journal of Computer Science and Technology, 2010, 第 2 作者(123) 片上多核处理器存储一致性验证, Memory Consistency Verification of Chip Multi-Processor, 软件学报, 2010, 第 2 作者(124) System Architecture of Godson-3 Multi-Core Processors, System Architecture of Godson-3 Multi-Core Processors, 计算机科学技术学报:英文版, 2010, 第 2 作者(125) LReplay: A Pending Period Based Deterministic Replay Scheme, ISCA 2010: THE 37TH ANNUAL INTERNATIONAL SYMPOSIUM ON COMPUTER ARCHITECTURE, 2010, 第 1 作者(126) 覆盖率驱动的随机测试生成技术综述, A Survey on Coverage Directed Generation Technology, 计算机辅助设计与图形学学报, 2009, 第 3 作者(127) Testing content addressable memories with physical fault models, Testing content addressable memories with physical fault models, 半导体学报, 2009, 第 4 作者(128) GODSON-3: A SCALABLE MULTICORE RISC PROCESSOR WITH X86 EMULATION, IEEE MICRO, 2009, 第 4 作者(129) Fast Complete Memory Consistency Verification, HPCA-15 2009: FIFTEENTH INTERNATIONAL SYMPOSIUM ON HIGH-PERFORMANCE COMPUTER ARCHITECTURE, PROCEEDINGS, 2009, 第 1 作者(130) Testing content addressable memories with physical fault models, Testing content addressable memories with physical fault models, JOURNAL OF SEMICONDUCTORS, 2009, 第 4 作者(131) 龙芯3号互联系统的设计与实现, Interconnection of Godson-3 Multi-Core Processor, 计算机研究与发展, 2008, 第 3 作者(132) 一种基于SAT的运算电路查错方法, A SAT-Based Arithmetic Circuit Bug-Hunting Method, 计算机学报, 2007, 第 1 作者(133) 龙芯2号微处理器浮点除法功能部件的形式验证, Formal Verification of Godson-2 Microprocessor Floating-Point Division Unit, 计算机研究与发展, 2006, 第 1 作者
发表著作
(1) 智能计算系统(第2版), 机械工业出版社, 2024-07, 第 1 作者(2) 智能计算系统, AI Computing Systems, Morgan Kaufmann, 2022-10, 第 1 作者(3) 智能计算系统实验教程, Experimental Course of AI Computing Systems, 机械工业出版社, 2021-08, 第 3 作者(4) 智能计算系统, AI Computing Systems, 机械工业出版社, 2020-02, 第 1 作者(5) 计算机体系结构, 清华大学出版社, 2011-06, 第 2 作者