肖侬

教授

联系邮箱: xiaon6@mail.sysu.edu.cn

教师简介: 

肖侬,博士、教授、博士生导师、中山大学国家超级计算广州中心副主任。获得国防科技大学计算机专业本博学位,教育部国家级高层次人才,国家杰出青年科学基金获得者、CCF Fellow。 曾任863重点专项“高效能计算机与网格服务环境”总体专家组成员,中国计算机学会海外杰出贡献奖评奖分委员会主席、中国计算机学会大数据专家委副主任,现任CCF信息存储专业委员会主任。负责国家重点研发、863、 973、国家自然科学基金重点项目等。肖侬教授是我国研究高性能网络计算技术的先行开拓者之一。获得国家科技进步二等奖2项、省部级一等奖和二等奖6项,发表论文200多篇。

研究领域: 

1、高性能计算与算力网:超智融合计算系统,算力网调度管理与协同计算

2、存储:大模型存储管理、大规模新型存储、大数据存储处理

3、系统结构:AI训推智能计算系统、量子计算

代表性论文: 

  • [CCF-A, HPCA 2026] Fuyu Wang, Minghua Shen, Yufei Ding, Nong Xiao, and Yutong Lu, “SFD: Towards Segment Fusion Dataflow for Spatial Accelerators”.
  • [CCF-A, HPCA 2026] Yanjing Wang, Lizhou Wu, Sunfeng Gao, Yibo Tang, Junhui Luo, Zicong Wang, Yang Ou, Dezun Dong, Nong Xiao, and Mingche Lai, “Cohet: A CXL-Driven Coherent Heterogeneous Computing Framework with Hardware-Calibrated Full-System Simulation”.
  • [CCF-A, FAST 2026] Yuda An, Shushu Yi, Bo Mao, Qiao Li, Mingzhe Zhang, Diyu Zhou, Ke Zhou, Nong Xiao, Guangyu Sun, Yingwei Luo, and Jie Zhang, “Xerxes: Extensive Exploration of Scalable Hardware Systems with CXL-Based Simulation Framework”.
  • [CCF-A, TCAD 2026] Yanjing Wang, Lizhou Wu, Wentao Hong, Yang Ou, Zicong Wang, Sunfeng Gao, Jie Zhang, Sheng Ma, Dezun Dong, Xingyun Qi, Mingche Lai, and Nong Xiao, “CXL-DMSim: A Full-System CXL Disaggregated Memory Simulator With Comprehensive Silicon Validation”.
  • [CCF-A, TKDE 2026] Dongyi Zheng, Lingzhi Wang, Jiyuan Feng, Xiangke Liao, Nong Xiao, Yonghong Tian, and Qing Liao, “ProitMTA: A Multi-Target Model Poisoning Attack Framework for Federated Recommendation Systems With Proxy Items”.
  • [CCF-A, ISCA 2025] Li Peng, Wenbo Wu, Shushu Yi, Xianzhang Chen, Chenxi Wang, Shengwen Liang, Zhe Wang, Nong Xiao, Qiao Li, Mingzhe Zhang, and Jie Zhang, “XHarvest: Rethinking High-Performance and Cost-Efficient SSD Architecture with CXL-Driven Harvesting”.
  • [CCF-A, TACO 2025] Fuyu Wang, Minghua Shen, Yutong Lu, and Nong Xiao, “Ceiba: An Efficient and Scalable DNN Scheduler for Spatial Accelerators”.
  • [CCF-A, TACO 2025] Minghua Shen, Aoxiang Qin, and Nong Xiao, “ODGS: Dependency-Aware Scheduling for High-Level Synthesis with Graph Neural Network and Reinforcement Learning”.
  • [CCF-A, DAC 2025] Xuanteng Huang, Jiangsu Du, Nong Xiao, and Xianwei Zhang, “PASK: Cold Start Mitigation for Inference with Proactive and Selective Kernel Loading on GPUs”.
  • [CCF-A, TCAD 2025] Aoxiang Qin, Rongjie Yang, Minghua Shen, and Nong Xiao, “PBS: Program Behavior-Aware Scheduling for High-Level Synthesis”.
  • [CCF-A, TPAMI 2025] Songyuan Yang, Weijiang Yu, Wenjing Yang, Xinwang Liu, Huibin Tan, Long Lan, and Nong Xiao, “WildVideo: Benchmarking LMMs for Understanding Video-Language Interaction”.
  • [CCF-A, SC 2025] Yuhao Gu, Haoquan Chen, Xianjie Chen, Jiangsu Du, Zhiguang Chen, Nong Xiao, Xianwei Zhang, and Yutong Lu, “coMtainer: Compilation-assisted HPC Container Images with Enhanced Adaptability”.
  • [CCF-A, SC 2025] Tianyu Guo, Xianwei Zhang, Jiangsu Du, Zhiguang Chen, Nong Xiao, and Yutong Lu, “gLLM: Global Balanced Pipeline Parallelism Systems for Distributed LLMs Serving with Token Throttling”.
  • [CCF-A, ISCA 2024] Fuyu Wang, Minghua Shen, Yufei Ding, and Nong Xiao, “Soter: Analytical Tensor-Architecture Modeling and Automatic Tensor Program Tuning for Spatial Accelerators”.
  • [CCF-A, SC 2024] Yuanxin Wei, Jiangsu Du, Jiazhi Jiang, Xiao Shi, Xianwei Zhang, Dan Huang, Nong Xiao, and Yutong Lu, “APTMoE: Affinity-Aware Pipeline Tuning for MoE Models on Bandwidth-Constrained GPU Nodes”.
  • [CCF-A, TCAD 2024] Hongbing Tan, Libo Huang, Zhong Zheng, Hui Guo, Qianming Yang, Li Shen, Gang Chen, Liquan Xiao, and Nong Xiao, “A Low-Cost Floating-Point Dot-Product-Dual-Accumulate Architecture for HPC-Enabled AI”.
  • [CCF-A, DAC 2024] Tianyu Guo, Xuanteng Huang, Kan Wu, Xianwei Zhang, and Nong Xiao, “SMILE: LLC-based Shared Memory Expansion to Improve GPU Thread Level Parallelism”.
  • [CCF-A, TC 2024] Fuyu Wang, Minghua Shen, Yutong Lu, and Nong Xiao, “TensorMap: A Deep RL-Based Tensor Mapping Framework for Spatial Accelerators”.
  • [CCF-A, PVLDB 2024] Qingyin Lin, Jiangsu Du, Rui Li, Zhiguang Chen, Wenguang Chen, and Nong Xiao, “IncrCP: Decomposing and Orchestrating Incremental Checkpoints for Effective Recommendation Model Training”.
  • [CCF-A, TPDS 2023] Yeting Guo, Fang Liu, Tongqing Zhou, Zhiping Cai, and Nong Xiao, “Privacy vs. Efficiency: Achieving Both Through Adaptive Hierarchical Federated Learning”.
  • [CCF-A, TPAMI 2023] Weijiang Yu, Haofan Wang, Guohao Li, Nong Xiao, and Bernard Ghanem, “Knowledge-Aware Global Reasoning for Situation Recognition”.
  • [CCF-A, TPDS 2022] Yinjin Fu, Yutong Lu, Zhiguang Chen, Yang Wu, and Nong Xiao, “Design and Simulation of Content-Aware Hybrid DRAM-PCM Memory System”.
  • [CCF-A, DAC 2022] Jinxi Kuang, Minghua Shen, Yutong Lu, and Nong Xiao, “Exploiting data locality in memory for ORAM to reduce memory access overheads”.
  • [CCF-A, TDSC 2022] Yinjin Fu, Nong Xiao, Tao Chen, and Jian Wang, “Fog-to-MultiCloud Cooperative Ehealth Data Management With Application-Aware Secure Deduplication”.
  • [CCF-A, TPDS 2021] Minghua Shen, Guojie Luo, and Nong Xiao, “Coarse-Grained Parallel Routing With Recursive Partitioning for FPGAs”.
  • [CCF-A, TPDS 2021] Jiangsu Du, Xin Zhu, Minghua Shen, Yunfei Du, Yutong Lu, Nong Xiao, and Xiangke Liao, “Model Parallelism Optimization for Distributed Inference Via Decoupled CNN Structure”.
  • [CCF-A, SC 2021] Hongzheng Chen, Minghua Shen, Nong Xiao, and Yutong Lu, “Krill: a compiler and runtime system for concurrent graph processing”.
  • [CCF-A, TCAD 2021] Zhengguo Chen, Youtao Zhang, and Nong Xiao, “CacheTree: Reducing Integrity Verification Overhead of Secure Nonvolatile Memories”.
  • [CCF-A, TCAD 2021] Minghua Shen, Guojie Luo, and Nong Xiao, “Combining Static and Dynamic Load Balance in Parallel Routing for FPGAs”.
  • [CCF-A, TC 2021] Dan Huang, Jun Wang, Qing Liu, Nong Xiao, Huafeng Wu, and Jiangling Yin, “Enhancing Proportional IO Sharing on Containerized Big Data File Systems”.
  • [CCF-A, TACO 2021] Ya-Shuai Lü, Hui Guo, Libo Huang, Qi Yu, Li Shen, Nong Xiao, and Zhiying Wang, “GraphPEG: Accelerating Graph Processing on GPUs”.
  • [CCF-A, IMWUT 2021] Yeting Guo, Fang Liu, Zhiping Cai, Hui Zeng, Li Chen, Tongqing Zhou, and Nong Xiao, “PREFER: Point-of-interest REcommendation with efficiency and privacy-preservation via Federated Edge leaRning”.
  • [CCF-A, TPDS 2019] Minghua Shen, Guojie Luo, and Nong Xiao, “Exploring GPU-Accelerated Routing for FPGAs”.
  • [CCF-A, TPDS 2020] Minghua Shen, Guojie Luo, and Nong Xiao, “EEPC: A Framework for Energy-Efficient Parallel Control of Connected Cars”.
  • [CCF-A, TCAD 2020] Minghua Shen, Hongzheng Chen, and Nong Xiao, “Entropy-Directed Scheduling for FPGA High-Level Synthesis”.
  • [CCF-A, TCAD 2020] Minghua Shen, Wentai Zhang, Guojie Luo, and Nong Xiao, “Serial-Equivalent Static and Dynamic Parallel Routing for FPGAs”.
  • [CCF-A, Bioinformatics 2020] Yaobin Ke, Jiahua Rao, Huiying Zhao, Yutong Lu, Nong Xiao, and Yuedong Yang, “Accurate prediction of genome-wide RNA secondary structure profile based on extreme gradient boosting”.
  • [CCF-A, TC 2019] Shuo Li, Nong Xiao, Peng Wang, Guangyu Sun, Xiaoyang Wang, Yiran Chen, Hai Helen Li, Jason Cong, and Tao Zhang, “RC-NVM: Dual-Addressing Non-Volatile Memory Architecture Supporting Both Row and Column Memory Accesses”.
  • [CCF-A, HPCA 2018] Peng Wang, Shuo Li, Guangyu Sun, Xiaoyang Wang, Yiran Chen, Hai Li, Jason Cong, Nong Xiao, and Tao Zhang, “RC-NVM: Enabling Symmetric Row and Column Memory Accesses for In-memory Databases”.
  • [CCF-A, TC 2016] Zhiguang Chen, Nong Xiao, Yutong Lu, and Fang Liu, “Me-CLOCK: A Memory-Efficient Framework to Implement Replacement Policies for Large Caches”.
  • [CCF-A, DAC 2016] Hang Zhang, Xuhao Chen, Nong Xiao, and Fang Liu, “Architecting energy-efficient STT-RAM based register file on GPGPUs via delta compression”.
  • [CCF-A, TPDS 2014] Yinjin Fu, Hong Jiang, Nong Xiao, Lei Tian, Fang Liu, and Lei Xu, “Application-Aware Local-Global Source Deduplication for Cloud Backup Services of Personal Storage”.
  • [CCF-A, TPDS 2014] Sheng Ma, Zhiying Wang, Natalie D. Enright Jerger, Li Shen, and Nong Xiao, “Novel Flow Control for Fully Adaptive Routing in Cache-Coherent NoCs”.
  • [CCF-A, TACO 2013] Libo Huang, Zhiying Wang, Nong Xiao, Yongwen Wang, and Qiang Dou, “Adaptive communication mechanism for accelerating MPI functions in NoC-based multicore processors”.
  • [CCF-A, SCIS 2013] Ming-che Lai, Lei Gao, Nong Xiao, and Zhiying Wang, “An accurate and highly-efficient performance evaluation approach based on queuing model for on-chip network”.
  • [CCF-A, TCAD 2013] Libo Huang, Zhiying Wang, Nong Xiao, Yongwen Wang, and Qiang Dou, “Dynamic Streamization Model Execution for SIMD Engines on Multicore Architectures”.
  • [CCF-A, TKDE 2013] Tao Chen, Lei Chen, M. Tamer Özsu, and Nong Xiao, “Optimizing Multi-Top-k Queries over Uncertain Data Streams”.
  • [CCF-A, TC 2012] Libo Huang, Sheng Ma, Li Shen, Zhiying Wang, and Nong Xiao, “Low-Cost Binary128 Floating-Point FMA Unit Design with SIMD Support”.
  • [CCF-A, SCIS 2012] Shaoliang Peng, Shanshan Li, Xiangke Liao, Yuxing Peng, and Nong Xiao, “A scalable code dissemination protocol in heterogeneous wireless sensor networks”.
  • [CCF-A, SCIS 2012] Nong Xiao, Yingjie Zhao, Fang Liu, and Zhiguang Chen, “Dual queues cache replacement algorithm based on sequentiality detection”.
  • [CCF-A, TSC 2011] Kaijun Ren, Nong Xiao, and Jinjun Chen, “Building Quick Service Query List Using WordNet and Multiple Heterogeneous Ontologies toward More Realistic Service Composition”.
  • [CCF-A, SCIS 2011] Nong Xiao, Zhiguang Chen, Fang Liu, Ming-che Lai, and Longfei An, “P3Stor: A parallel, durable flash-based SSD for enterprise-scale storage systems”.
  • [CCF-A, HPCA 2010] Libo Huang, Li Shen, Zhiying Wang, Wei Shi, Nong Xiao, and Sheng Ma, “SIF: Overcoming the limitations of SIMD devices via implicit permutation”.
  • [CCF-A, SCIS 2010] Nong Xiao, Wei Fu, and Xicheng Lu, “QoS-awared replica placement techniques in data grid applications”.