叶笑春  研究员  

研究方向:

所属部门:高通量计算机研究中心、处理器芯片全国重点实验室

导师类别:博导

联系方式:yexiaochun@ict.ac.cn

个人网页:

简       历:

主要从事高通量众核处理器以及人工智能、图计算等加速结构研究,作为核心骨干参与高性能众核处理器Godson-T、高通量众核处理器DPU等多款众核芯片的研制。主持国家自然科学基金、国家重点研发计划、中科院先导等课题十余项。在包括ISCA、MICRO、HPCA、ASPLOS、TC、TPDS等在内的领域知名会议/期刊上发表学术论文100余篇,授权发明专利30余项。入选中科院青促会优秀会员,曾获北京市技术发明一等奖,CCF技术发明二等奖,北京市科学技术二等奖等奖励。

主要论著:

近年代表性会议文章:

[1] Haibin Wu, Wenming Li, Zhihua Fan, Zirui Ma, Yuqun Liu, Tengfei Xia, Yanhuan Liu, Kunming Zhang, Xiaochun Ye, Dongrui Fan, Jian Weng. MLX: Multi-Layer Execution for Structured LLM Workload Acceleration on Spatial Architectures. The 53rd Annual International Symposium on Computer Architecture (ISCA) 2026.  Best Paper Candidate

[2] Yanhuan Liu, Wenming Li, Kunming Zhang, Yuqun Liu, Siao Wen, Lexin Wang, Tianyu Liu, Haibin Wu, Zhihua Fan, Xiaochun Ye, Dongrui Fan, Xuejun An. BitRed: Taming Non-Uniform Bit-Level Sparsity with a Programmable RISC-V ISA for DNN Acceleration. International Conference on Architectural Support for Programming Languages and Operating Systems (ASPLOS) 2026

[3] Runzhen Xue, Hao Wu, Mingyu Yan, Ziheng Xiao, Xiaochun Ye and Dongrui Fan. MetaDSE: A Few-Shot Meta-Learning Framework for Cross-Workload CPU Design Space Exploration. 62nd ACM/IEEE Design Automation Conference (DAC), 2025

[4] Runzhen Xue, Mingyu Yan, Dengke Han, Yihan Teng, Zhimin Tang, Xiaochun Ye, Dongrui Fan. GDR-HGNN: A Heterogeneous Graph Neural Networks Accelerator Frontend with Graph Decoupling and Recoupling. 61st ACM/IEEE Design Automation Conference (DAC), 2024.

[5] Duo Wang, Mingyu Yan, Xin Liu, Mo Zou, Tianyu Liu, Wenming Li, Xiaochun Ye and Dongrui Fan. A High-accurate Multi-objective Exploration Framework for Design Space of CPU. 60th ACM/IEEE Design Automation Conference (DAC), 2023.

[6] Haiyang Lin, Mingyu Yan, Duo Wang, Mo Zou, Fengbin Tu, Xiaochun Ye, Dongrui Fan, Yuan Xie. Alleviating Datapath Conflicts and Design Centralization in Graph Analytics Acceleration. 59th ACM/IEEE Design Automation Conference (DAC), 2022.

[7] Dingyuan Cao, Mingzhe Zhang, Hang Lu, Xiaochun Ye, Dongrui Fan, Yuezhi Che, Rujia Wang. Streamline Ring ORAM Accesses through Spatial and Temporal Optimization. In the 27th IEEE International Symposium on High-Performance Computer Architecture (HPCA), 2021.

[8] Mingyu Yan, Lei Deng, Xing Hu, Ling Liang, Yujing Feng, Xiaochun Ye, Zhimin Zhang, Dongrui Fan, Yuan Xie. HyGCN: A GCN Accelerator with Hybrid Architecture. IEEE International Symposium on High Performance Computer Architecture (HPCA), 2020.

[9] Mingyu Yan, Xing Hu, Shuangchen Li, Abanti Basak, Han Li, Xin Ma, Itir Akgun, Yujing Feng, Peng Gu, Lei Deng, Xiaochun Ye, Zhimin Zhang, Dongrui Fan, Yuan Xie. Alleviating Irregularity in Graph Analytics Acceleration: a Hardware/Software Co-Design Approach. Proceedings of the 52nd Annual IEEE/ACM International Symposium on Microarchitecture (MICRO), 2019.

[10] Dongrui Fan, Wenming Li, Xiaochun Ye, Da Wang, Hao Zhang, Zhimin Tang, Ninghui Sun. SmarCo: An Efficient Many-Core Processor for High-Throughput Applications in Datacenters. In the 24th IEEE International Symposium on High-Performance Computer Architecture (HPCA), 2018.


近年代表性期刊论文:

[1] Zhihua Fan, Jing Xue, Wenming Li, Xuejun An, Xiaochun Ye. A RISC-V Extended Infrastructure for Edge FHE Through Software and Hardware Co-Design. IEEE Transactions on Computer-Aided Design of Integrated Circuits and Systems (TCAD). 2026.

[2] Yuan Zhang, Huawei Cao, Yue Shen, Sibo Li, Yang Feng, Chunxiang Wang, Xuejun An, Xiaochun Ye: A Comprehensive Survey on Dynamic Graph Processing: Storage and Analytics.  IEEE Transactions on Knowledge and Data Engineering (TKDE), 2026

[3] Wenming Li, Zhihua Fan, Tianyu Liu, Zhen Wang, Haibin Wu, Meng Wu, Kunming Zhang, Yanhuan Liu, Ninghui Sun, Xiaochun Ye, Dongrui Fan. DFU-E: A Dataflow Architecture for Edge DSP and AI Applications. IEEE Transactions on Parallel and Distributed Systems (TPDS), 2025.

[4] Zhen Wang, Tianyu Liu, Zhihua Fan, Wenming Li, Yuhang Qiu, Zhiyuan Zhang, Xuejun An, Dongrui Fan, Xiaochun Ye. Compressing and Accelerating Sparse CNNs Using Sign-Reserved Toeplitz Filters and Input Activation Density-aware Dataflow. ACM Transactions on Architecture and Code Optimization (TACO), 2025

[5] Runzhen Xue, Dengke Han, Mingyu Han, Mo Zou, Xiaocheng Yang, Duo Wang, Wenming Li, Zhimin Tang, John Kim, Xiaochun Ye, Dongrui Fan. HiHGNN: Accelerating HGNNs through Parallelism and Data Reusability Exploitation. IEEE Transactions on Parallel and Distributed Systems (TPDS), 2024.

[6] Zhihua Fan, Wening Li, Zhen Wang, Yu Yang, Xiaochun Ye, Dongrui Fan, Ninghui Sun, Xuejun An. Improving Utilization of Dataflow Unit for Multi-Batch Processing. ACM Transactions on Architecture and Code Optimization (TACO), 2024.

[7] Zhihua Fan, Wenming Li, Zhen Wang, Tianyu Liu, Haibin Wu, Yanhuan Liu, Meng Wu, Xinxin Wu, Xiaochun Ye, Dongrui Fan, Ninghui Sun, Xuejun An. Accelerating Convolutional Neural Networks by Exploiting the Sparsity of Output Activation. IEEE Transactions on Parallel and Distributed Systems (TPDS), 2023.

[8] Haiyang Lin, Mingyu Yan, Xiaochun Ye, Dongrui Fan, Shirui Pan, Wenguang Chen, and Yuan Xie. A Comprehensive Survey on Distributed Training of Graph Neural Networks. Proceedings of the IEEE (PIEEE), 2023.

[9] Gongjian Sun, Mingyu Yan, Duo Wang, Han Li, Wenming Li, Xiaochun Ye, Dongrui Fan, Yuan Xie. Multi-node Acceleration for Large-scale GCNs. IEEE Transactions on Computers (TC),2022.

[10] Rongliang Fu, Junying Huang, Haibin Wu, Xiaochun Ye, Dongrui Fan, Tsung-Yi Ho. JBNN: A Hardware Design for Binarized Neural Networks using Single-Flux-Quantum Circuits. IEEE Transactions on Computers (TC), 2022.

科研项目:

获奖及荣誉: