Accepted Papers
The following 135 papers have been accepted for presentation at the 2026 ACM SIGOPS Annual Technical Conference (ATC 2026).
-
Scaling LLM Agent Tool Access: The MCP Gateway
Mingxin Li (Nanjing University and Alibaba Cloud); Enge Song, Yueshang Zuo, Xiaodong Liu (Alibaba Cloud); Rong Wen (Fudan University and Alibaba Cloud); Qiang Fu (RMIT University); Gianni Antichi (Politecnico di Milano); Jian He, Jing Tie, Zhou Shao, Xiaobo Xue, Xiong Xiao, Luyao Zhong, Shaokai Zhang, Jiangu Zhao, Jianyuan Lu, Shize Zhang, Xiaoqing Sun, Changgang Zheng, Zihao Fan, Haonan Li, Tian Pan, Xiaomin Wu, Yang Song (Alibaba Cloud); Xing Li (Zhejiang University and Alibaba Cloud); Biao Lyu (Alibaba Cloud); Meng Li, Haipeng Dai, Guihai Chen (Nanjing University); Shunmin Zhu (Alibaba Cloud) -
UniSketch: A Unified Sketch for Efficient General Flow Spread Measurement
He Huang, Yifan Han (Soochow University); Chen Lou (University of Science and Technology of China); Yang Du, Yu-E Sun (Soochow University); Jia Liu (Nanjing University); Zhongjun Qiu (Soochow University); Fu Xiao (Nanjing University of Posts and Telecommunications); Guoju Gao (Soochow University); shigang chen (University of Florida) -
SwiftBaton: Dependency-Aware Staged Reconstruction for Live Migration of Stateful Containers
Xianzhi Zhu, Gonggu Chen (University of Science and Technology of China); Yancan Mao, Richard Ma (National University of Singapore); Lulu Yao (Ningbo University); Yongkun Li, Yinlong Xu (University of Science and Technology of China); John C.S. Lui (The Chinese University of Hong Kong) -
Starfish: Fault-Tolerant Far Memory with Low Resource and Performance Overhead
Yanwen Xia (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Benyong Deng (Huazhong University of Science and Technology); Hong Huang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Yuzheng Wang (Peking University); Quanxi Li (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Xingda Wei (Shanghai Jiao Tong University); Xiaobing Feng, Huimin Cui, Chenxi Wang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences) -
Quiver: Taming Throughput-Latency Tradeoff in GPU-SSD ANNS
Puqing Wu (Renmin University of China); Minhui Xie (Nanjing University); Yiheng Tong (Renmin University of China); Jie Yin, Sen Yang (Tencent Inc.); Yunpeng Chai (Renmin University of China) -
Building Memory Efficient Key-Value Stores in the CXL Era
Theodore Michailidis (University of California, San Diego); Steven Swanson, Jishen Zhao (UCSD) -
The GPU Changes Everything: Rethinking GPU I/O Stack at Massive Scale
Guanyi Chen, Jian Zhang (The Hong Kong University of Science and Technology (Guangzhou)) -
UniMM: Enabling Automated and Unified Memory Model Description
Chen Gao, Xiangwei Meng (Lanzhou University); Fengyuan Ren (Lanzhou University / Tsinghua University) -
δSandbox: Millisecond-Scale Sandbox Checkpoint and Rollback for Stateful AI Agents
Yunpeng Dong, Jingkai He, Shiqi Liu, Yuze Hou, Dong Du (Shanghai Jiao Tong University); Zhonghu Xu, Si Yu, Baochuan Yang (Huawei Technologies Co., Ltd.); Yubin Xia, Haibo Chen (Shanghai Jiao Tong University) -
CacheFS: Peer-to-Peer Cooperative Caching for LLM Weight Distribution at Cloud Scale
Zheng Liu (Zhejiang University, Alibaba Group); Eryu Guan, Shang Zhao (Alibaba Group); Chengkun Wei (Zhejiang University); Teng Ma (Alibaba Group); Jin Shi (Zhejiang University); Ye Cao, Chen Cao, Wenpeng Li, Tao He, Wenyuan Yu, Tao Ma (Alibaba Group); Wenzhi Chen (Zhejiang University) -
gKSM: GPU Memory Deduplication at Driver Layer for Serverless LLM Inference
Shuheng Gao (University of Science and Technology of China); Fan Guo (MinJiang University); Yongkun Li, Ziye Yue (University of Science and Technology of China); Yinlong Xu (University of Science and Technology of China, MinJiang University); John C.S. Lui (The Chinese University of Hong Kong) -
Clockwork: A Compiler for Composable Network Simulation Schedulers
Hao Li, Yihan Dang, Danfeng Shan, Peng Zhang (Xi'an Jiaotong University) -
Faastion: Elastic and Scalable Native Library Isolation for High-Density Serverless Platforms
Miguel Lourenço (INESC-ID, Instituto Superior Técnico, Universidade de Lisboa); Rahul Kondlapudi (Purdue University); Serhii Ivanenko, Rodrigo Cidra (INESC-ID, IST, ULisboa); Pedro Fonseca (Purdue University); Rodrigo Bruno (INESC-ID, Instituto Superior Técnico, University of Lisbon) -
Workload Analysis of a Production BigData-Storage Cluster for ML and Data Analytics
Runhua Bian (Tsinghua University, ByteDance); Jinxin Liu (ByteDance); Hao Guo (Tsinghua University); Shaoyu Zhang, Liqiang Zhang, Zhongbao Zhang (ByteDance); Jiwu Shu, Youyou Lu (Tsinghua University) -
LifeSketch: Lifecycle-aware Active Flow Counting on Programmable Switches
He Huang, Hanwen Zhang, Yang Du (Soochow University); Jia Liu (Nanjing University); Zhongjun Qiu, Yu-E Sun (Soochow University); Yao Tian, Xiaofang Zhou (The Hong Kong University of Science and Technology); Fu Xiao (Nanjing University of Posts and Telecommunications) -
SAIL: Scalable In-Network-Assisted Loss Recovery for Cross-Datacenter RDMA
Xiao Li, Haoyuan Yu, Yuan Yang, Mingwei Xu (Tsinghua University) -
AgentMesh: Toward Redundancy- and Barrier-Free Dataflow in Multi-Agent Systems
Yuchen Xu (Peking University); Yang Li (Huawei); Yitao Yuan, Nengyuan Zhang (Peking University); Yaojing Wang (Huawei); Haoyu You, Xiaohan Hou, Shaoke Fang, Mingrui Liu, Mufeng Liu (Peking University); Chen Sun, Xia Zhu, Bingyang Liu (Huawei); Wenfei Wu (Peking University) -
Sharing is caring: Attestable and Trusted Cloud Pipelines out of Distrustful Components
Amir Al Sadi, Sina Abdollahi (Imperial College London); Adrien Ghosn (Microsoft Azure Research); Hamed Haddadi, Marios Kogias (Imperial College London) -
Chameleon: Adaptive Memory Overcommitment for Disaggregated Virtual Machines
Yilong Luo (Peking University); Yulong Zhang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Siyuan Xu (Tongji University); Siyi Zhang (SAIS, University of Chinese Academy of Sciences); Yanwen Xia (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Mingyu Wu (Shanghai Jiao Tong University); Diyu Zhou, Tao Xie (Peking University); Chenxi Wang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences) -
SynDebug: A Framework to Debug Logic Bugs in Fault-Tolerant Quantum Computing Programs
Nick DiBrita (Rice University); Jack Lange (Oak Ridge National Lab); Tirthak Patel (Rice University) -
Detecting and Localizing Network Faults in RoCE-Based AI Clouds under Restricted Telemetry
Sinuo Cao, Weiqi Zhu, Jie Gui, Jintao He, Qun Huang (National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University); Hao Liang, Yang Wang, Bolong Cui, Tingfeng Jiang, Weiling Gu, Tao Peng, Xudong Liu, Ronghua Sun, Zhi Zhang, Xiangyang Wu, Wei Song (Huawei Technologies Co. Ltd) -
SptcAttn: Accelerating Long-Context Attention with Diagonal Stripes using Sparse Tensor Core
Chenpeng Wu, Qiqi Gu (Shanghai Jiao Tong University); Heng Shi (Shanghai Enflame Technology Co.Ltd; Shanghai Jiao Tong University); Jianguo Yao, Haibing Guan (Shanghai Jiao Tong University) -
DESAN: READ/WRITE-Aware Redundant Sanitizer Check Elimination
Yunlong Xing, Shiyu Sun, Kun Sun (George Mason University) -
LiveART: Scaling WebRTC Ingestion
Jing Liu, Jianlin Xu (ByteDance Inc.); Bo Wang (Bytedance Inc.); Sandesh Dhawaskar Sathyanarayana (Bytedance); Wei Cao, Liang Yin (Bytedance Inc.); Feng Qian (ByteDance); Shu Shi (Bytedance Inc.) -
PAVE: Prebuilding Address Translations for Fast Nested MicroVM Restore
Muhan Song, Xingguo Pang, Li Li, Xiaobo Zhou (University of Macau) -
TensorBridge: Bridging Microscaled FP4 Weights to FP8 Tensor Cores for LLM Serving
Jiaxiang Zou, Yonghao Chen, Rui Meng, Ruilong WU, Xinyu Chen (The Hong Kong University of Science and Technology (Guangzhou)) -
Mosaic: Efficient CPU–GPU Coordinated Block-Sparse Attention for Long-Context Decoding
Feiyu Yao (Beijing University of Technology); Zhixiong Niu (Microsoft Research); Xiaqing Li (Beijing Jiaotong University); Yongqiang Xiong (Microsoft Research); Juan Fang, Qian Wang (Beijing University of Technology) -
Fine-Grained Loss Recovery via Packet-Level Content-Awareness for Ultra-low-latency Video Communications
Wei Li (Hong Kong University of Science and Technology); Zhewen Yang (Northeastern University); Hua Meng, Zili Meng (Hong Kong University of Science and Technology) -
SOLO: Making Single-Local-Replica Storage Practical for Geo-Distributed Recommendation Model Training
Tao Li, Long Deng (University of Science and Technology of China); Xinyuan Li, Xukun Chen, Zheyu Lin, Shibo Chen, ShiRu Ren, Jingwei Xu, Wei Zhang, Jianhui Lu, Yong Tian, Bin Zhang, Wei Feng, Yang Guo, Hang Cheng, Jixi Shan, Jun Song (ByteDance China); Wenzhe Zhu, Yongkun Li, Yinlong Xu (University of Science and Technology of China) -
HybridFaaS: Efficient GPU Serverless via Hybrid Autoscaling
Hao Ming, Chencheng Ye, XIAOFEI LIAO, Hai Jin, Qiang-Sheng Hua (Huazhong University of Science and Technology); Yuanchao Xu (University of California, Santa Cruz) -
System A: An Open Platform for AI-Based Bandwidth Estimation in Real-Time Communications
Wenxue Cheng (Microsoft Research); Jeongyoon Eo (Seoul National University & Microsoft Research); Zhixiong Niu (Microsoft Research); Francis Y. Yan (University of Illinois Urbana-Champaign); Rui Gao (Microsoft Research); Ze Gan, Scott Inglis, Vishak Gopal (Microsoft); Byung-Gon Chun (Seoul National University); Ran Shu, Peng Cheng, Yongqiang Xiong (Microsoft Research) -
ATP: Workload-Adaptive Scheduling for Goodput-Optimized Tensor-Parallel LLM Serving with PD Disaggregation
Yinhe Chen, Dongqi Tian, Youhui Bai (University of Science and Technology of China); Chaoyi Ruan (NUS); Jiaan Zhu (University of Science and Technology of China); Long Zhao, Qinghe Wang (Anhui University; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center); Cheng Li (University of Science and Technology of China; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center) -
TwinCache: A Retrieval- and Reranking-Aware Caching System for Efficient RAG Serving
Youxuan Xu, Rongtian Fu, Shigang Li, Jinliang Shi, Tong Wu, Zhi Ma (Beijing University of Posts and Telecommunications) -
Operating System Policies in the Wild
Yushan Qin (UW-Madison); Ananya Virmani (University of Wisconsin--Madison); Sungkar Bolat (student); Ayushi Chaudhary (University of Wisconsin-Madison); Nida Tanveer Ul Hasan (University of Wisconsin--Madison); Mai Zheng (Iowa State University); Sebastian Angel (University of Pennsylvania); Christopher J. Rossbach (UT Austin and Microsoft); Michael Swift (University of Wisconsin--Madison) -
A Novel AI-Native GPU Kernel Programming Language for Autonomous Kernel Tuning
Heng Shi, Xiaofeng Guan (Shanghai Enflame Intelligence Technologies Co.,Ltd.; Shanghai Jiao Tong University); Sijie Wu, Enming Fan (Shanghai Enflame Intelligence Technologies Co.,Ltd.); Chenpeng Wu, Qiqi Gu (Shanghai Jiao Tong University); Jiahang Xie, Guoqing Bao (Shanghai Enflame Intelligence Technologies Co.,Ltd.); Jianguo Yao (Shanghai Jiao Tong University) -
DittoCache: From CPU-Orchestrated to GPU-Centric KVCache for Efficient LLM Decoding
Jia He (University of Science and Technology of China; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center); Youhui Bai, Jiawei Yi, Ping Gong, Zewen Jin (University of Science and Technology of China); Shannon Wang (Institute of Artificial Intelligence, Hefei Comprehensive National Science Center); Jiaqi Ruan, Jiaan Zhu (University of Science and Technology of China); Pengcheng Wang, Haibo Wang, Weiguang Wang (Huawei); Xia Zhu (Huawei Technologies Co., Ltd); Cheng Li (University of Science and Technology of China; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center) -
TraJudger: Structure-Guided Failure Attribution for LLM-Powered Multi-Agent Systems
Yongxin Zhao, Shenglin Zhang, Wenwei Gu, Zijing Que, Weiwen Qian, Yongqian Sun (Nankai University); Li Shi, Wei Li, Liping Zhang (Alibaba Group); Dan Pei (Tsinghua University) -
Model-as-a-Service in the Wild: Characterizing Production LLM Inference Clusters at Scale
Yiyun Zheng (The Chinese University of Hong Kong, Shenzhen); Lingyun Yang, Yinghao Yu, Guodong Yang, Liping Zhang (Alibaba Group); Minchen Yu (The Chinese University of Hong Kong, Shenzhen) -
D-Pingmesh: Dynamic Probing and Fault Localization for Reconfigurable Datacenter Networks
Yunze Wei (Tsinghua University); Kaicheng Yang (Huawei); Xiaohui Xie, Dunkai Mao (Tsinghua University); Peiying Tao, Yikai Zhao, Bolong Cui, Chen Sun, Bingyang Liu (Huawei); Kun Tan (Unaffiliated); Kai Chen (Hong Kong University of Science and Technology); Yong Cui (Tsinghua University) -
HeapLENS: Heap Layout Evaluation & Navigation Suite
Trevor Brown, Sean Ovens, Gautam Pathak (University of Waterloo) -
CAVER: Enhancing RDMA Load Balancing by Hunting Less-Congested Paths
Haotian Deng (Tsinghua University); Jue Zhang, Menghao Zhang (Beihang University); Yuan Yang (Tsinghua University); Xiao Li (Department of Computer Science and Technology, Tsinghua University); Junhao Dong, Yi Liu, Mingwei Xu (Tsinghua University) -
CacheSched: A Cache-Aware Scheduler for LLM Inference Requests
Rilin Huang (Peking University); Junyi Shu (UCLA); Yaofeng Tu (Nanjing Branch of ZTE Corporation); Xin Jin (Peking University) -
ATLAS: Expert-Guided Sustainable Satellite Backhaul for Off-Grid Wildlife Monitoring
Hao Fang, Miao Zhang, Haoyuan Zhao, Long Chen, Yi Ching Chou, Chi Xu (Simon Fraser University); Cheng Pan (The University of Hong Kong); Jiangchuan Liu (Simon Fraser University) -
Instrumentation Optimization for Practical Dynamic Race Detection
Alexey Paznikov, Michael Schwarz (National University of Singapore); Andrey Kogutenko, Yaroslav Osipov (Saint Petersburg Electrotechnical University "LETI"); Umang Mathur (National University of Singapore) -
SymRDMA: Enabling In-Situ Remote Virtual Memory Sharing
Huijun Shen (Hunan University); Bojie Li (Pine AI); Haixin Pang (Hunan University); Peihao Huang (Hunan university); Xingtong Lin, Xingyu Zhang, Guo Chen (Hunan University) -
JANUS: Practical Load Balancing for Confidential Cloud Services
Qi Guo (Max Planck Institute for Informatics); Alice Dethise, Ruichuan Chen, Istemi Ekin Akkus, Ivica Rimac, Lieven Trappeniers (Nokia Bell Labs) -
Zswap Boost: Accelerating Transparent Memory Compression in the Cloud
Zheng Liu (Zhejiang University, Alibaba Cloud Computing); Teng Ma (Alibaba Group); Chengkun Wei (Zhejiang University); Ning Zhang (Alibaba Group); Xingyu Liu (Zhejiang University); Gang Deng (Alibaba Cloud); Shangming Cai (Alibaba Group); Wenzhi Chen (Zhejiang University) -
TraceScope: A Modular Framework for Practical Transaction Isolation Verification
Jian Zhang (Northeastern University); Shuai Mu (Stony Brook University); Cheng Tan (Northeastern University) -
NosRacer: Dynamic Detection of Race Conditions in On-Device Network Operating Systems
Runze Wu, Jingbo Zhai (Nanjing University); Shanming Ping, Lingzhi Ouyang, Hua Duan, Qin Zou, Chengcheng Huang, Bingshe Liu, Xudong Lang (Huawei Technologies Co., Ltd); Xiaoxing Ma, Yu Huang (Nanjing University) -
Lean: Saving OSS Network Cost by Application-Infrastructure Coordination
Qiankun Yue, Kun Qian, Jiashi Lu (Alibaba Cloud); Xue Li (Alibaba Group); Qingchao Luo, Weibin Yan, Zhihong Li, Jianyao Sun, Junping Liang, Yuyao Chen, Liefeng Rong, Jing Zhang, Ensheng Xu, Boyu Ying, Fanghu Zheng, Guangren Chai, Erci Xu, Yuanchao Su, Dennis Cai (Alibaba Cloud) -
FlashCodec: Unleash All Decoding Resources for Low-Latency Video Decoding in MLLM Inference
Lingxiao Zhao, Haoran Zhou, Yuezhi Che, Rongyu Luo (Wuhan University); Dazhao Cheng (WuHan University) -
A^2: Characterizing and Mitigating Imbalanced Reclaim in MGLRU via Active Aging at Production Scale
Fei Zeng (Central South University); Zicheng Wang, Ligeng Chen (Honor Device Co., Ltd); Yinggang Guo (Honor Device Co.,Ltd); Hao Wu (Nanjing University); Lu Liu, Tao Wang, Jun Xiao (Honor Device Co.,Ltd); Borui Li (Southeast University); Feng Lyu (Central South University) -
Medivh: Harnessing Compatible and Accurate Sketch-based Network Measurement with Sparsity-based Virtualization
Xiang Chen (Zhejiang University); Feng Zhu (Independent Researcher); Hongmin Tan, Jiayu Li, Jiashuo Yu, Longlong Zhu, Xingyuan Li, Yuchen Xian, Jiajie Su, Xingwei Lin, Qiang Wu, Chunming Wu (Zhejiang University) -
Joseph: Hypervisor–RDMA Co-Design for Kernel-Bypass Remote MicroVM SnapStart
Xingguo Pang (Unversity of Macau); Muhan Song, Chuang Hu, Kanye Ye Wang (University of Macau); Dazhao Cheng (WuHan University); Xiaobo Zhou (University of Macau) -
Octopus: Unlocking SSD Parallelism for Sparse KV Cache Retrieval
Tuowei Wang, Liyun Chu, Ruwen Fan, Ju Ren (Tsinghua University) -
FM2: Fast Live VM Migration in CXL Memory Pools
Zezhou Wang, Jonggyu Park (University of Washington); Shihang (Vic) Li (University of Washington; Google); Pedro Henrique Penna (Microsoft Research); Thomas E. Anderson, Simon Peter (University of Washington) -
Efficient Training on Multiple Consumer GPUs with MovingPipe
Yibin Luo, Shiwei Gao, Huichuan Zheng, Youyou Lu, Jiwu Shu (Tsinghua University) -
MoE-Lego: A Plane-Grained System for Dynamic-Precision MoE Offloading
Haozhe Wei, Xiaofeng Hou, Wenfeng Wang, Cheng Xu (Shanghai Jiao Tong University); Jiacheng Liu (Hong Kong University of Science and Technology); Chao Li, Minyi Guo (Shanghai Jiao Tong University) -
Chorus: GPU–CPU Cooperative LLM Serving for Length-Skewed Decode
Dong Chen, Yukun Zhou, Sheng Yao (Hong Kong University of Science and Technology); Ruichuan Chen (Nokia Bell Labs); Binhang Yuan, Shuai Wang (Hong Kong University of Science and Technology); Luping Wang, Cheng Huang, Guodong Yang, Liping Zhang (Alibaba Group); Wei Wang (Hong Kong University of Science and Technology) -
IBTpoline: Flexible, Robust, and Intel IBT-compliant System Call Hooking
Alexander J. Gaidis (Brown University); Ioulios Patmanidis (TU Delft); Isabelle Shapiro (Brown University); Georgios Portokalidis (IMDEA Software Institute); Alexios Voulimeneas (TU Delft); Vasileios P. Kemerlis (Brown University) -
InfiniLoRA: Disaggregated Multi-LoRA Serving for Large Language Models
Hongyu Chen, Letian Ruan (Shanghai Jiao Tong University); Zilin Xu (Bytedance); Yuchen Li (Singapore Management Univerisity); Xinyu Chen (The Hong Kong University of Science and Technology (Guangzhou)); Bingsheng He (National University of Singapore); Jingwen Leng, Jieru Zhao, Shixuan Sun, Minyi Guo (Shanghai Jiao Tong University) -
Dasheng: LLM-powered Reliability Engineering Assistant for Cloud Overlay Networks
Yining Qi (Zhejiang University); Chongrong Fang (Shanghai Jiao Tong University); Xiaoqing Sun (Alibaba Cloud); Tong Wu (Zhejiang University); Jiaxiang Chen (Shanghai Jiao Tong University); Xiaobo Xue (Alibaba Cloud); Shize Zhang (Alibaba Group); Xiaonan Shi, Yangyang Shi, Shuai Yang, Xiong Xiao (Alibaba Cloud); Peng Cheng, Jiming Chen (Zhejiang University); Biao Lyu (Alibaba Cloud) -
BPFFoundary: Scalable and Practical Multi eBPF Program Composition and Testing at Meta.
Prankur Gupta, Takshak Chahande, Miao Xu, Prashanth Kannan, Tejas Birajdar, Lilian Liu, Rajiv Krishnamurthy (Meta); Theophilus A. Benson (Carnegie Mellon University) -
fRAC: Remote Accelerator Calls on FPGAs
Ziyi Yang, Krishnan B. Iyer, Yixi Chen (KAUST); Ran Shu (Microsoft Research); Zsolt István (TU Darmstadt); Marco Canini, Suhaib Fahmy (KAUST) -
Dynamic Analysis of Unsafe Rust: Behaviors and Benchmarks
Jiaye Fang, Arsalan Bin Najeeb, Dylan O'Neill (The George Washington University); Prince Noah Johnson (University of Notre Dame); Zhixiao Zhang, Jie Zhou (The George Washington University) -
RunaSan: A Rust-Native Sanitizer for Precise and Context-Sensitive Sanitization
Jongyoon Kim, Kyuwon Cho, Hojoon Lee (Sungkyunkwan University) -
REFlash: Reducing Total Endurance Cost in Flash-Based Tiering via Cross-Tier Write Balancing
Sejun Kwon (Samsung Electronics and Seoul National University); Minwook Kim, Jin-Soo Kim (Seoul National University) -
DAG-KV: DAG-Guided KV Propagation for Structure-Aware Knowledge Reuse
Wenbin Zhu, Zhaoyan Shen, Qian Wei (Shandong University); Xin YAO, Xi Peng, Wei Zhang, Renhai Chen, Gong Zhang (Huawei Technologies Co., Ltd); Hongjun Dai, Dongxiao Yu, Shujian Zhao (Shandong University) -
Flitter: Exploiting Voltage Glitches and Frequency Jitter to Create Cross-core Covert Channels on Modern CPUs
Yucheng Ji (Tsinghua University); Chang Liu (National University of Singapore); Trevor E. Carlson (National University of Singapore, Google); Dongsheng Wang, Weidong Liu (Tsinghua University) -
FLASH: Fault-Led, Attested, Secure Hybrid-Key Checkpoint for Confidential GPU
Jonghyun Lee (University of Southern California); Taewoon Kang (Korea University); Pratheek B (NVIDIA); Yongqin Wang (Roblox); Rachit Rajat (NVIDIA); Mengyuan Li (USC); Gunjae Koo (Korea University); Daniel Wong (University of California, Riverside); Murali Annavaram (USC) -
ELDR: Expert-Locality-Aware Decode Routing for PD-Disaggregated MoE Serving
Sangjin Choi, Sukmin Cho (KAIST); Yifan Xiong (Microsoft Research); Ziyue Yang (Shanghai Xingyunzhili Artificial Intelligence Institute); Youngjin Kwon (KAIST); Peng Cheng (Microsoft Research) -
BPF-Ext: Safely Extending the eBPF Compilation Pipeline with Native Operations
Yusheng Zheng (UC Santa Cruz); Zhengjie Ji (Virginia Tech); weichen tao (Telecom Paris); Hao Sun (ETH Zurich); Wei Zhang (University of Connecticut); Dan Williams (Virginia Tech); Andi Quinn (University of California Santa Cruz) -
MBCheck: Practical Static Analysis Framework for Detecting Memory Ordering Violations under WMM
Jaidev Shastri, Binoy Ravindran (Virginia Tech) -
RS-Infer: A Fast and Secure LLM Inference System for Mobile Devices with Recallable Resource Isolation
Yinpeng Wu, Yitong Chen, Lixiang Wang, Jinyu Gu, Zhichao Hua, Yubin Xia (Shanghai Jiao Tong University) -
KVLite: Efficient LLM Agent Scheduling via Head-Aware KV Sharing
Jiaqi Si, Dezun Dong (National University of Defense Technology) -
STRIDE: Efficient Secure Transformer Inference via Inter-Operator Protocol and Operator Co-Design
Zhengyi Li (Shanghai Jiao Tong University); Yangjie Zhou (National University of Singapore); Zihan Liu, ZIYU XIAO (Shanghai Jiao Tong University); Kang Yang (State Key Laboratory of Cryptology); Jiaping Gui, Yu Feng, Yun Lin (Shanghai Jiao Tong University); Jin Song Dong (National University of Singapore); Yu Yu, Minyi Guo, Ning Liu, Jingwen Leng (Shanghai Jiao Tong University) -
Towards Robust Cache Hits with Scalability via a Middle Layer Representing Workload Preferences
Kunpeng Ding, Jiangping Han, Kaiping Xue, Qiangqiang Wei (University of Science and Technology of China) -
AutoTailor: Automatic and Efficient Adaptive Model Deployment for Diverse Edge Devices
Mengyang Liu (Southeast University); Chenyu Lu (The Hong Kong University of Science and Technology (Guangzhou)); Haodong Tian (Southeast University, Tsinghua University); Fang Dong, Ruiting Zhou (Southeast University); Wei Wang (HKUST); Dian Shen, Guangtong Li, Ye Wan (Southeast University); Li Li (University of Macau) -
Astragalus: Automatic Configuration Repair for Production Networks
Zhenrong Gu, Peng Zhang, Xing Feng, Xu Liu (Xi'an Jiaotong University) -
SwiftMPC: Accelerating ML under MPC with Secure-Chip-Assisted One-Way Communication
Tianze Song, Chengkun Wei (Zhejiang University); Yichen Tu, Yangming Zhang, Heng Cai, Haiyuan Gao (Alibaba Cloud); Yuyang Cui (Tianjin University); Minghong Tang, Jin Shi, Tong Chen, Yin Zhang (Zhejiang University); Wei Wang (Alibaba Group); Wenzhi Chen (Zhejiang University) -
Requests of a Feather Must Flock Together: Batch Size vs. Prefix Homogeneity in LLM Inference
Saksham Rathi, Preeti, Mythili Vutukuru (Indian Institute of Technology Bombay) -
Rocks, Pebbles and Sand: Modality-aware Scheduling for Multimodal Large Language Model Inference
Konstantinos Papaioannou, Thaleia Dimitra Doudali (IMDEA Software Institute) -
Detecting API Misuses Across Context Boundaries in Linux Kernel Drivers
Thomas Fourier, Julia Lawall, Baptiste Lepers (Inria) -
JetFire: Approximate-then-Correct Attention on Hybrid Memory for Long-Context LLM Inference
Feng Yu, Hongshi Tan (National University of Singapore); Yao Chen (Huazhong University of Science and Technology); Gustavo Alonso (ETH Zürich); Weng-Fai Wong, Bingsheng He (National University of Singapore) -
Energy-Aware Scheduling for Serverless LLM Serving on Shared GPUs
Tianyu Wang (University of Pittsburgh); Gourav Rattihalli, Aditya Dhakal (HPE Labs); Longfei Shangguan (University of Pittsburgh & Google); Dejan Milojicic (HPE Labs) -
Cloudless Tomorrow: A Memory-Centric System for Self-Improving Device-Cloud LLM Agents
Zeyu Qiu, Yaohui Wang, Shuyi Wang (Huazhong University of Science and Technology); Yu Kuang (School of Computer Science and Technology Huazhong University of Science and Technology); Qinbin Li, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology) -
UBASE: An AI Search Engine for Trillion-Scale Vector Data Management
Yao Tian, Yuncheng Lu, Liyao Xiong (Bytedance); Yuming Xu (ByteDance); Hao Zhang, Weichen Zhao (Bytedance); Xi Zhao, Bo Kuang, Dongyu Wang, Jiehui Li, Yakun Li, Lei Zhang (ByteDance) -
DiGiT: Co-Designing GNN Algorithms and Storage I/O for Out-of-Core Training Acceleration
Qian Wei (Shandong University); Yi Li (The University of Texas at Dallas); Junchi Ren, Zehao Chen, Zhaoyan Shen, Dongxiao Yu (Shandong University); Bingzhe Li (University of Texas at Dallas) -
Axon: Asynchronous Global KV-Aware Scheduling Across Distributed Instances for Agentic Workloads
Yuqi Qiu, Jinting Zou (University of Macau); Zizhao Mo (Great Bay University and University of Macau); Junlin Chen (University of Macau); Liao Chen (University of Macau, Macau SAR, China); Huanle Xu (University of Macau); Guoyao Xu, Guodong Yang, Liping Zhang (Alibaba Group); ChengZhong Xu (University of Macau) -
Understanding and Detecting Atomicity Violation Bugs in Distributed Database Transaction Mechanisms
Zhiyong Wu (School of Software, Tsinghua University); Jie Liang (Beihang University); Jingzhou Fu, Chi Zhang (Tsinghua University); Heyuan Shi (Central South University); Yu Jiang (Tsinghua University) -
Hardening Programs with Data Value Space Randomization of Semantically Arbitrary Values
Jaeyoon Kim, Hajeong Lim, Kyuwon Cho, Hojoon Lee (Sungkyunkwan University) -
Everything you always wanted to know about RDMA-based distributed Key-Value Stores
Paul Breuil (Inria and University of Sydney); Sumit Kumar Monga, Baptiste Lepers (Inria) -
BMV: Breaking Monolithic Verification for Fast Speculative LLM Inference
Dongxu Liu, Bing Zhu, Xinyu Zhu, Long Zheng, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology); Jingling Xue (UNSW Sydney) -
PrefixFlow: Training-Time KV Caching for Schedule-Level Prefix Reuse in LLM RL Training
Pengbo Li, Feiyuan Zhang (Hong Kong University of Science and Technology); Guangming Sheng (Tencent); Guangxin He (Hong Kong University of Science and Technology); Di Chai (Shanghai University of Finance and Economics); Ziniu Li (Tencent); Taiqiang Wu (The University of Hong Kong); Han Tian (The University of Science and Technology of China); Wenyu Mao (Tencent); Binhang Yuan, Kai Chen (Hong Kong University of Science and Technology) -
Fuzz Testing on IPC Based OS Services with Resource State Awareness
Yuheng Shen, Yifei Chu (Tsinghua University); Fan Ding (Central South University); Jianzhong Liu (Tsinghua University); Qiang Zhang (Jiangxi University of Finance and Economics); Heyuan Shi (Central South University); Yu Jiang (Tsinghua University) -
IgniteServe: Accelerating LLM Serving Engine Cold Starts via Fine-Grained Parallelization
Wenbiao Cao, Hang Huang (Huazhong University of Science and Technology); Jia Rao (The University of Texas at Arlington); Zhuo Huang, Song Wu, Hai Jin (Huazhong University of Science and Technology) -
SubSan: Efficient Memory Error Detection via Subtraction Checks
Jeonghwan Kang, Kyounghwan Kim, Donghyun Kwon (Pusan National University) -
Make Graphs Great Again: Rethinking LLM Agent Architecture via Structure-Semantic Separation
Jingyi Jia, Jiale Wang, Haoyi Zhang, Qinbin Li, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology) -
Demystifying the Performance of Kernel-Bypass TCP Stacks
Minhu Wang, Mingwei Xu, Jianping Wu (Tsinghua University) -
Understanding and Detecting Performance Regressions in Modern Open-Source Server Applications
Jinze Si (Shanghai Jiao Tong University); Xiaoqian Ma (Shanghai JiaoTong University); Mingyu Wu, Haibo Chen (Shanghai Jiao Tong University) -
Skip it, don't speed it. Accelerating Graph Pattern Matching through Disjoint Intersection Bypassing
Haotian Ma, Wei-Chung Hsu, Yeh-Ching Chung (The Chinese University of Hong Kong, Shenzhen) -
HKVQ: Homomorphic KV Quantization for Disaggregated LLM Inference
Zeyu Zhang, Haiying Shen (University of Virginia); Shay Vargaftik (VMware Research); Ran Ben Basat (University College London); Michael Mitzenmacher, Minlan Yu (Harvard University) -
MoECatch: Efficient Checkpointing and Consistent Recovery for Mixture-of-Experts Models
Guorui Xu, Xiang Liu (Southeast University); Weiwei Wu (Southeast university, P. R. China); Keni Qiu (Capital Normal University); Guang Kou (Defense Innovation Institute); Chenchen Fu (Southeast University); Jianping Wang (City University of Hong Kong) -
Unipool: Efficient Management of Pre-Provisioned Resources for Container Platforms
Hanfei Yu (Stevens Institute of Technology); Enrique Saurez, Íñigo Goiri (Microsoft Azure Research - Systems); Hao Wang (Stevens Institute of Technology); Rodrigo Fonseca (Microsoft Azure Research - Systems) -
Courier: Host-Transparent Direct Network I/O for Secure Containers in Cloud VMs
Hang Huang, Zhucan Ye (Huazhong University of Science and Technology); Zhiheng Tao (Ant Group); Hui Lu (The University of Texas at Arlington); Wenlong Hou (Ant Group); Wei Guo, Quan Xu, Jiang Liu (Alibaba Group); Jiangshan Lai (Ant Group); Jia Rao (The University of Texas at Arlington); Zhuo Huang, Song Wu, Chen Yu, Hai Jin (Huazhong University of Science and Technology) -
SeaStore: Redesigning Ceph’s Storage Backend for CPU-Efficient NVMe Performance
Myoungwon Oh (Korea Aerospace University); Yingxin Cheng (DDN); Matan Breizman, Josh Durgin (IBM) -
Breaking Host-Wide Blocking: Boundary-Closure SCSI Error Handling
Dongdong Hao (Xiamen University); Ye Xu (LeapIO Inc.); Jiazheng Zhang (Xiamen University); Xiaoyang Wang, Shuo Wang (LeapIO Inc.); Jiwu Shu (Xiamen University) -
EvoFuzz: IR-Aware Fuzzing for JIT Compilers through the Lens of Node Evolution
Jinze Si (Shanghai Jiao Tong University); Yuchen Sun (parissun@sjtu.edu.cn); Mingyu Wu, Haibo Chen (Shanghai Jiao Tong University) -
SplineFS: Adaptive Learned Directory Indexing for Memory-Constrained Filesystems
Jianqaing Zeng, Shaocong Sun (Peking University); Chengying Huan (Nanjing University); Peng Wang (Huazhong University of Science and Technology); Ke Zhou (Huazhong University of Science and Technology (HUST)); Yingwei Luo, Xiaolin Wang (Peking University); Zhenlin Wang (Michigan Tech); Diyu Zhou (Peking University); Yingdi Shan (Tsinghua University); Jie Zhang (Peking University) -
XCG: Decoupling Control from Configuration to Improve Cgroup Scalability with Flat Mapping
ruofan xiong (Xiamen University); Li Wang (KylinSoft); Zhihao Zhang (Tsinghua University); Xinbiao Gan (NUDT & HUST); Yiming Zhang (Shanghai Jiao Tong University) -
Premature Hardware Binding is the Root of all Evil! Making Serverless Performance-Portable with Lazy Hardware Binding
Serhii Ivanenko (INESC-ID, Instituto Superior Técnico, University of Lisbon); Carlos Segarra (Imperial College London); Rodrigo Bruno (INESC-ID, Instituto Superior Técnico, University of Lisbon) -
FlexMARL: Graph-Driven Rollout-Training Co-Design for LLM-Based Multi-Agent Reinforcement Learning
Zhida Jiang, Zhaolong Xing, Jiawei Lu (JD.com); Yipei Niu (Huawei); Qingyuan Sang, Liangxu Zhang (JD.com); Wenquan Dai (Huawei); Junhua Shu, Jiaxing Wang (JD.com); Qiangyu Pei, Qiong Chen, Xinyu Liu (Huawei); Fangming Liu (Huazhong University of Science and Technology); Ai Han, Zhen Chen, Ke Zhang (JD.com) -
EntangledEdge: Orbital Quantum Sensing and Learning as a New Class of Distributed Systems
Mohammad Abrarul Hasanat, Amit Samanta (University of Utah); Jason Ludmir, Tirthak Patel (Rice University); Rohan Basu Roy (University of Utah) -
Storage Evolution for Exascale Supercomputers: Lessons from Sunway TaihuLight to OceanLight
Bin Yang, Cheng Su (Tianjin University); Hao Wei (Tsinghua University); Wenze Du, Jiwei Yan, Shihan Zhang (Tianjin University); Wei Xue (Tsinghua University); Ce Yu (Tianjin University) -
Bypassing Android System Services for Fast UI Responsiveness: A Kernel-Application Co-Design Approach
Zizhan Chen (The Chinese University of Hong Kong); Renhai Chen (Huawei Technologies Co., Ltd); Zili Shao (The Chinese University of Hong Kong) -
Plurio: Scaling Microkernel-based Operating System via Service Localization and Memory Pooling
Zhenlin Qi, Shengan Zheng, Bowen Zhang, Linpeng Huang (Shanghai Jiao Tong University) -
Beyond Target Placement: Unified Multi-Objective Path-Aware Offline VM Scheduling at Scale
Zihan Xu, Zhidong Hu, Zhengtong Zhang, Fei Peng, Kaiyuan Shen, Feng Wang, Xiangyun Kong, Binda Ma, Jian Zhou (Alibaba Cloud Computing) -
EMDedup: Accelerating DLRM via In-Network EMbedding Layer Deduplication
Wenjie Li (SKLP, Institute of Computing Technology, Chinese Academy of Sciences; Zhengzhou University); Ke Liu, Zhao Zhang (SKLP, Institute of Computing Technology, Chinese Academy of Sciences); Ning Liu, Hui Yuan, Zixuan Guan, Xiaolong Zheng (Huawei); Xu Zhang, Kefan Liu (SKLP, Institute of Computing Technology, Chinese Academy of Sciences); Guanghui Zhang (Shandong University); Yungang Bao (ICT, CAS); Mingyu Chen (SKLP, Institute of Computing Technology, Chinese Academy of Sciences); Chenxi Wang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences) -
Cold-Patching for Faster Edit-Compile-Run Cycles
Matthew Sotoudeh (Stanford University) -
FDP-Rocks: An Effective Use Case of FDP in RocksDB
Jian Zhou (University of Texas at Arlington); Inho Song (Virginia Tech); Chen Zhong (University of texas at arlington); Peiran Du, Lingfeng Xiang (The University of Texas at Arlington); Sam H. Noh (Virginia Tech); Wenguang Wang (Broadcom Inc.); Jia Rao (The University of Texas at Arlington); Song Jiang (University of Texas at Arlington) -
HYPIC: Position-Independent Caching for Hybrid-Attention LLM Serving
Yifei Liu (Xiaohongshu Inc.); Juntong Wu (Peking University); Yang Liu (Shanghai Jiao Tong University); Junhao Hu (Peking University); Minghao Li, Xiaoxu Chen, Weihang Chen (Xiaohongshu Inc.) -
CoreCapture: Anomaly-Aware System Trace Sampling for Resource-Constrained Mobile Devices
Yongqian Sun, Xiaotian Wang, Yicheng Sui, Jintao Feng, Yue Zhang, Shenglin Zhang (Nankai University); Bowen Zheng, Qiang Li, Wei Liang (Huawei); Dan Pei (Tsinghua University) -
Rattan: An Extensible and Scalable Modular Internet Path Emulator
Yixin Shen, Minhu Wang, Bo Wang, Haixuan Tong, Chenghao Li, Yutong Xie, Yixuan Gao, Mingwei Xu, Jianping Wu (Tsinghua University) -
AccFS: An Accelerator-Aware File System for Non-Volatile Memory
Sangjin Lee, Taehwan Ahn, Yongseok Son (Chung-Ang University) -
brg-pk: A Practical Verified High-Throughput Kernel Lock for OpenBSD
David Gwynne, Robert Colvin (University of Queensland); Brijesh Dongol (University of Surrey); Roger Su (Australian National University); Daniel Wright (University of Surrey) -
HybridQC: Hardware-Grounded Simulation of Tightly Integrated Hybrid Quantum-Classical Systems
Panayiotis Christou, Shuwen Kan, Ying Mao (Fordham University) -
ESROS2: Application Sandboxes for Secure ROS2
Dev Tejas Gandhi, Vinod Ganapathy (Indian Institute of Science Bangalore) -
Resi-DINC: Resilient Distributed In-Network Computing with Closed-Loop Runtime Assurance
Xiaoying Huang, Kun Huang, Mengqian Pang (Pengcheng Laboratory) -
Spectra: Bandwidth-Faithful Data Placement for Tiered Memory
Jiahui Zhang, Qiang Cao (Huazhong University of Science and Technology); Hong Jiang (UT Arlington) -
Towards High-Throughput Collective Communication via Harnessing PCIe and Dedicated Interconnects
Yuezheng Liu, Menghao Zhang, Xuebin Song, Juner Shen, Chunming Hu, Xudong Liu (Beihang University) -
Efficient Strict Serializability for Stateful Serverless Workflows via Workflow Reconciliation
Shenghao Ao (Shanghai Jiao Tong University); Zijun Li (Department of Computer Science and Engineering, Shanghai Jiao Tong University); Chuhao Xu, Quan Chen (Shanghai Jiao Tong University); Shuo Quan (Cloud Computing Research Institute, China Telecom); Yanan Yang (China Telecom Cloud Computing Research Institute); Jie Wu (Temple University, China Telecom Cloud Computing Research Institute); Meiqi Zhu, Yujun Wang (China Telecom Cloud Technology Co., Ltd.); Minyi Guo (Shanghai Jiao Tong University) -
Schedules Are Solvable Symbols: Tuning-Free Compilation of Tile Programs on Dataflow Architectures
Heru Wang, Zhenyu Bai, Wei Li, Tulika Mitra (National University of Singapore) -
EBFuzz: Breaking Hidden Structural Assumptions in Compilers via Extended Assembly Injection
Jiangchang Wu, Yibiao Yang (State Key Laboratory for Novel Software Technology, Nanjing University) -
HeadFlow: Scaling Long-Context Training with Head-Group Activation Residency
Yixin Song, Jianxiang Gao (Shanghai Jiao Tong University); Shuhuai Zhang (Zhejiang University); Zeyu Mi, Haibo Chen (Shanghai Jiao Tong University) -
Lightweight Memory Tracing via General Binary Analysis and Offline Reconstruction
Ziheng Liu, Steven Swanson (University of California, San Diego)
Note: For each accepted paper, at least one author must have a full (non-student) registration.