Accepted Papers

The following 135 papers have been accepted for presentation at the 2026 ACM SIGOPS Annual Technical Conference (ATC 2026).

  • Scaling LLM Agent Tool Access: The MCP Gateway
    Mingxin Li (Nanjing University and Alibaba Cloud); Enge Song, Yueshang Zuo, Xiaodong Liu (Alibaba Cloud); Rong Wen (Fudan University and Alibaba Cloud); Qiang Fu (RMIT University); Gianni Antichi (Politecnico di Milano); Jian He, Jing Tie, Zhou Shao, Xiaobo Xue, Xiong Xiao, Luyao Zhong, Shaokai Zhang, Jiangu Zhao, Jianyuan Lu, Shize Zhang, Xiaoqing Sun, Changgang Zheng, Zihao Fan, Haonan Li, Tian Pan, Xiaomin Wu, Yang Song (Alibaba Cloud); Xing Li (Zhejiang University and Alibaba Cloud); Biao Lyu (Alibaba Cloud); Meng Li, Haipeng Dai, Guihai Chen (Nanjing University); Shunmin Zhu (Alibaba Cloud)
  • UniSketch: A Unified Sketch for Efficient General Flow Spread Measurement
    He Huang, Yifan Han (Soochow University); Chen Lou (University of Science and Technology of China); Yang Du, Yu-E Sun (Soochow University); Jia Liu (Nanjing University); Zhongjun Qiu (Soochow University); Fu Xiao (Nanjing University of Posts and Telecommunications); Guoju Gao (Soochow University); shigang chen (University of Florida)
  • SwiftBaton: Dependency-Aware Staged Reconstruction for Live Migration of Stateful Containers
    Xianzhi Zhu, Gonggu Chen (University of Science and Technology of China); Yancan Mao, Richard Ma (National University of Singapore); Lulu Yao (Ningbo University); Yongkun Li, Yinlong Xu (University of Science and Technology of China); John C.S. Lui (The Chinese University of Hong Kong)
  • Starfish: Fault-Tolerant Far Memory with Low Resource and Performance Overhead
    Yanwen Xia (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Benyong Deng (Huazhong University of Science and Technology); Hong Huang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Yuzheng Wang (Peking University); Quanxi Li (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Xingda Wei (Shanghai Jiao Tong University); Xiaobing Feng, Huimin Cui, Chenxi Wang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences)
  • Quiver: Taming Throughput-Latency Tradeoff in GPU-SSD ANNS
    Puqing Wu (Renmin University of China); Minhui Xie (Nanjing University); Yiheng Tong (Renmin University of China); Jie Yin, Sen Yang (Tencent Inc.); Yunpeng Chai (Renmin University of China)
  • Building Memory Efficient Key-Value Stores in the CXL Era
    Theodore Michailidis (University of California, San Diego); Steven Swanson, Jishen Zhao (UCSD)
  • The GPU Changes Everything: Rethinking GPU I/O Stack at Massive Scale
    Guanyi Chen, Jian Zhang (The Hong Kong University of Science and Technology (Guangzhou))
  • UniMM: Enabling Automated and Unified Memory Model Description
    Chen Gao, Xiangwei Meng (Lanzhou University); Fengyuan Ren (Lanzhou University / Tsinghua University)
  • δSandbox: Millisecond-Scale Sandbox Checkpoint and Rollback for Stateful AI Agents
    Yunpeng Dong, Jingkai He, Shiqi Liu, Yuze Hou, Dong Du (Shanghai Jiao Tong University); Zhonghu Xu, Si Yu, Baochuan Yang (Huawei Technologies Co., Ltd.); Yubin Xia, Haibo Chen (Shanghai Jiao Tong University)
  • CacheFS: Peer-to-Peer Cooperative Caching for LLM Weight Distribution at Cloud Scale
    Zheng Liu (Zhejiang University, Alibaba Group); Eryu Guan, Shang Zhao (Alibaba Group); Chengkun Wei (Zhejiang University); Teng Ma (Alibaba Group); Jin Shi (Zhejiang University); Ye Cao, Chen Cao, Wenpeng Li, Tao He, Wenyuan Yu, Tao Ma (Alibaba Group); Wenzhi Chen (Zhejiang University)
  • gKSM: GPU Memory Deduplication at Driver Layer for Serverless LLM Inference
    Shuheng Gao (University of Science and Technology of China); Fan Guo (MinJiang University); Yongkun Li, Ziye Yue (University of Science and Technology of China); Yinlong Xu (University of Science and Technology of China, MinJiang University); John C.S. Lui (The Chinese University of Hong Kong)
  • Clockwork: A Compiler for Composable Network Simulation Schedulers
    Hao Li, Yihan Dang, Danfeng Shan, Peng Zhang (Xi'an Jiaotong University)
  • Faastion: Elastic and Scalable Native Library Isolation for High-Density Serverless Platforms
    Miguel Lourenço (INESC-ID, Instituto Superior Técnico, Universidade de Lisboa); Rahul Kondlapudi (Purdue University); Serhii Ivanenko, Rodrigo Cidra (INESC-ID, IST, ULisboa); Pedro Fonseca (Purdue University); Rodrigo Bruno (INESC-ID, Instituto Superior Técnico, University of Lisbon)
  • Workload Analysis of a Production BigData-Storage Cluster for ML and Data Analytics
    Runhua Bian (Tsinghua University, ByteDance); Jinxin Liu (ByteDance); Hao Guo (Tsinghua University); Shaoyu Zhang, Liqiang Zhang, Zhongbao Zhang (ByteDance); Jiwu Shu, Youyou Lu (Tsinghua University)
  • LifeSketch: Lifecycle-aware Active Flow Counting on Programmable Switches
    He Huang, Hanwen Zhang, Yang Du (Soochow University); Jia Liu (Nanjing University); Zhongjun Qiu, Yu-E Sun (Soochow University); Yao Tian, Xiaofang Zhou (The Hong Kong University of Science and Technology); Fu Xiao (Nanjing University of Posts and Telecommunications)
  • SAIL: Scalable In-Network-Assisted Loss Recovery for Cross-Datacenter RDMA
    Xiao Li, Haoyuan Yu, Yuan Yang, Mingwei Xu (Tsinghua University)
  • AgentMesh: Toward Redundancy- and Barrier-Free Dataflow in Multi-Agent Systems
    Yuchen Xu (Peking University); Yang Li (Huawei); Yitao Yuan, Nengyuan Zhang (Peking University); Yaojing Wang (Huawei); Haoyu You, Xiaohan Hou, Shaoke Fang, Mingrui Liu, Mufeng Liu (Peking University); Chen Sun, Xia Zhu, Bingyang Liu (Huawei); Wenfei Wu (Peking University)
  • Sharing is caring: Attestable and Trusted Cloud Pipelines out of Distrustful Components
    Amir Al Sadi, Sina Abdollahi (Imperial College London); Adrien Ghosn (Microsoft Azure Research); Hamed Haddadi, Marios Kogias (Imperial College London)
  • Chameleon: Adaptive Memory Overcommitment for Disaggregated Virtual Machines
    Yilong Luo (Peking University); Yulong Zhang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Siyuan Xu (Tongji University); Siyi Zhang (SAIS, University of Chinese Academy of Sciences); Yanwen Xia (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences); Mingyu Wu (Shanghai Jiao Tong University); Diyu Zhou, Tao Xie (Peking University); Chenxi Wang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences)
  • SynDebug: A Framework to Debug Logic Bugs in Fault-Tolerant Quantum Computing Programs
    Nick DiBrita (Rice University); Jack Lange (Oak Ridge National Lab); Tirthak Patel (Rice University)
  • Detecting and Localizing Network Faults in RoCE-Based AI Clouds under Restricted Telemetry
    Sinuo Cao, Weiqi Zhu, Jie Gui, Jintao He, Qun Huang (National Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University); Hao Liang, Yang Wang, Bolong Cui, Tingfeng Jiang, Weiling Gu, Tao Peng, Xudong Liu, Ronghua Sun, Zhi Zhang, Xiangyang Wu, Wei Song (Huawei Technologies Co. Ltd)
  • SptcAttn: Accelerating Long-Context Attention with Diagonal Stripes using Sparse Tensor Core
    Chenpeng Wu, Qiqi Gu (Shanghai Jiao Tong University); Heng Shi (Shanghai Enflame Technology Co.Ltd; Shanghai Jiao Tong University); Jianguo Yao, Haibing Guan (Shanghai Jiao Tong University)
  • DESAN: READ/WRITE-Aware Redundant Sanitizer Check Elimination
    Yunlong Xing, Shiyu Sun, Kun Sun (George Mason University)
  • LiveART: Scaling WebRTC Ingestion
    Jing Liu, Jianlin Xu (ByteDance Inc.); Bo Wang (Bytedance Inc.); Sandesh Dhawaskar Sathyanarayana (Bytedance); Wei Cao, Liang Yin (Bytedance Inc.); Feng Qian (ByteDance); Shu Shi (Bytedance Inc.)
  • PAVE: Prebuilding Address Translations for Fast Nested MicroVM Restore
    Muhan Song, Xingguo Pang, Li Li, Xiaobo Zhou (University of Macau)
  • TensorBridge: Bridging Microscaled FP4 Weights to FP8 Tensor Cores for LLM Serving
    Jiaxiang Zou, Yonghao Chen, Rui Meng, Ruilong WU, Xinyu Chen (The Hong Kong University of Science and Technology (Guangzhou))
  • Mosaic: Efficient CPU–GPU Coordinated Block-Sparse Attention for Long-Context Decoding
    Feiyu Yao (Beijing University of Technology); Zhixiong Niu (Microsoft Research); Xiaqing Li (Beijing Jiaotong University); Yongqiang Xiong (Microsoft Research); Juan Fang, Qian Wang (Beijing University of Technology)
  • Fine-Grained Loss Recovery via Packet-Level Content-Awareness for Ultra-low-latency Video Communications
    Wei Li (Hong Kong University of Science and Technology); Zhewen Yang (Northeastern University); Hua Meng, Zili Meng (Hong Kong University of Science and Technology)
  • SOLO: Making Single-Local-Replica Storage Practical for Geo-Distributed Recommendation Model Training
    Tao Li, Long Deng (University of Science and Technology of China); Xinyuan Li, Xukun Chen, Zheyu Lin, Shibo Chen, ShiRu Ren, Jingwei Xu, Wei Zhang, Jianhui Lu, Yong Tian, Bin Zhang, Wei Feng, Yang Guo, Hang Cheng, Jixi Shan, Jun Song (ByteDance China); Wenzhe Zhu, Yongkun Li, Yinlong Xu (University of Science and Technology of China)
  • HybridFaaS: Efficient GPU Serverless via Hybrid Autoscaling
    Hao Ming, Chencheng Ye, XIAOFEI LIAO, Hai Jin, Qiang-Sheng Hua (Huazhong University of Science and Technology); Yuanchao Xu (University of California, Santa Cruz)
  • System A: An Open Platform for AI-Based Bandwidth Estimation in Real-Time Communications
    Wenxue Cheng (Microsoft Research); Jeongyoon Eo (Seoul National University & Microsoft Research); Zhixiong Niu (Microsoft Research); Francis Y. Yan (University of Illinois Urbana-Champaign); Rui Gao (Microsoft Research); Ze Gan, Scott Inglis, Vishak Gopal (Microsoft); Byung-Gon Chun (Seoul National University); Ran Shu, Peng Cheng, Yongqiang Xiong (Microsoft Research)
  • ATP: Workload-Adaptive Scheduling for Goodput-Optimized Tensor-Parallel LLM Serving with PD Disaggregation
    Yinhe Chen, Dongqi Tian, Youhui Bai (University of Science and Technology of China); Chaoyi Ruan (NUS); Jiaan Zhu (University of Science and Technology of China); Long Zhao, Qinghe Wang (Anhui University; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center); Cheng Li (University of Science and Technology of China; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center)
  • TwinCache: A Retrieval- and Reranking-Aware Caching System for Efficient RAG Serving
    Youxuan Xu, Rongtian Fu, Shigang Li, Jinliang Shi, Tong Wu, Zhi Ma (Beijing University of Posts and Telecommunications)
  • Operating System Policies in the Wild
    Yushan Qin (UW-Madison); Ananya Virmani (University of Wisconsin--Madison); Sungkar Bolat (student); Ayushi Chaudhary (University of Wisconsin-Madison); Nida Tanveer Ul Hasan (University of Wisconsin--Madison); Mai Zheng (Iowa State University); Sebastian Angel (University of Pennsylvania); Christopher J. Rossbach (UT Austin and Microsoft); Michael Swift (University of Wisconsin--Madison)
  • A Novel AI-Native GPU Kernel Programming Language for Autonomous Kernel Tuning
    Heng Shi, Xiaofeng Guan (Shanghai Enflame Intelligence Technologies Co.,Ltd.; Shanghai Jiao Tong University); Sijie Wu, Enming Fan (Shanghai Enflame Intelligence Technologies Co.,Ltd.); Chenpeng Wu, Qiqi Gu (Shanghai Jiao Tong University); Jiahang Xie, Guoqing Bao (Shanghai Enflame Intelligence Technologies Co.,Ltd.); Jianguo Yao (Shanghai Jiao Tong University)
  • DittoCache: From CPU-Orchestrated to GPU-Centric KVCache for Efficient LLM Decoding
    Jia He (University of Science and Technology of China; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center); Youhui Bai, Jiawei Yi, Ping Gong, Zewen Jin (University of Science and Technology of China); Shannon Wang (Institute of Artificial Intelligence, Hefei Comprehensive National Science Center); Jiaqi Ruan, Jiaan Zhu (University of Science and Technology of China); Pengcheng Wang, Haibo Wang, Weiguang Wang (Huawei); Xia Zhu (Huawei Technologies Co., Ltd); Cheng Li (University of Science and Technology of China; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center)
  • TraJudger: Structure-Guided Failure Attribution for LLM-Powered Multi-Agent Systems
    Yongxin Zhao, Shenglin Zhang, Wenwei Gu, Zijing Que, Weiwen Qian, Yongqian Sun (Nankai University); Li Shi, Wei Li, Liping Zhang (Alibaba Group); Dan Pei (Tsinghua University)
  • Model-as-a-Service in the Wild: Characterizing Production LLM Inference Clusters at Scale
    Yiyun Zheng (The Chinese University of Hong Kong, Shenzhen); Lingyun Yang, Yinghao Yu, Guodong Yang, Liping Zhang (Alibaba Group); Minchen Yu (The Chinese University of Hong Kong, Shenzhen)
  • D-Pingmesh: Dynamic Probing and Fault Localization for Reconfigurable Datacenter Networks
    Yunze Wei (Tsinghua University); Kaicheng Yang (Huawei); Xiaohui Xie, Dunkai Mao (Tsinghua University); Peiying Tao, Yikai Zhao, Bolong Cui, Chen Sun, Bingyang Liu (Huawei); Kun Tan (Unaffiliated); Kai Chen (Hong Kong University of Science and Technology); Yong Cui (Tsinghua University)
  • HeapLENS: Heap Layout Evaluation & Navigation Suite
    Trevor Brown, Sean Ovens, Gautam Pathak (University of Waterloo)
  • CAVER: Enhancing RDMA Load Balancing by Hunting Less-Congested Paths
    Haotian Deng (Tsinghua University); Jue Zhang, Menghao Zhang (Beihang University); Yuan Yang (Tsinghua University); Xiao Li (Department of Computer Science and Technology, Tsinghua University); Junhao Dong, Yi Liu, Mingwei Xu (Tsinghua University)
  • CacheSched: A Cache-Aware Scheduler for LLM Inference Requests
    Rilin Huang (Peking University); Junyi Shu (UCLA); Yaofeng Tu (Nanjing Branch of ZTE Corporation); Xin Jin (Peking University)
  • ATLAS: Expert-Guided Sustainable Satellite Backhaul for Off-Grid Wildlife Monitoring
    Hao Fang, Miao Zhang, Haoyuan Zhao, Long Chen, Yi Ching Chou, Chi Xu (Simon Fraser University); Cheng Pan (The University of Hong Kong); Jiangchuan Liu (Simon Fraser University)
  • Instrumentation Optimization for Practical Dynamic Race Detection
    Alexey Paznikov, Michael Schwarz (National University of Singapore); Andrey Kogutenko, Yaroslav Osipov (Saint Petersburg Electrotechnical University "LETI"); Umang Mathur (National University of Singapore)
  • SymRDMA: Enabling In-Situ Remote Virtual Memory Sharing
    Huijun Shen (Hunan University); Bojie Li (Pine AI); Haixin Pang (Hunan University); Peihao Huang (Hunan university); Xingtong Lin, Xingyu Zhang, Guo Chen (Hunan University)
  • JANUS: Practical Load Balancing for Confidential Cloud Services
    Qi Guo (Max Planck Institute for Informatics); Alice Dethise, Ruichuan Chen, Istemi Ekin Akkus, Ivica Rimac, Lieven Trappeniers (Nokia Bell Labs)
  • Zswap Boost: Accelerating Transparent Memory Compression in the Cloud
    Zheng Liu (Zhejiang University, Alibaba Cloud Computing); Teng Ma (Alibaba Group); Chengkun Wei (Zhejiang University); Ning Zhang (Alibaba Group); Xingyu Liu (Zhejiang University); Gang Deng (Alibaba Cloud); Shangming Cai (Alibaba Group); Wenzhi Chen (Zhejiang University)
  • TraceScope: A Modular Framework for Practical Transaction Isolation Verification
    Jian Zhang (Northeastern University); Shuai Mu (Stony Brook University); Cheng Tan (Northeastern University)
  • NosRacer: Dynamic Detection of Race Conditions in On-Device Network Operating Systems
    Runze Wu, Jingbo Zhai (Nanjing University); Shanming Ping, Lingzhi Ouyang, Hua Duan, Qin Zou, Chengcheng Huang, Bingshe Liu, Xudong Lang (Huawei Technologies Co., Ltd); Xiaoxing Ma, Yu Huang (Nanjing University)
  • Lean: Saving OSS Network Cost by Application-Infrastructure Coordination
    Qiankun Yue, Kun Qian, Jiashi Lu (Alibaba Cloud); Xue Li (Alibaba Group); Qingchao Luo, Weibin Yan, Zhihong Li, Jianyao Sun, Junping Liang, Yuyao Chen, Liefeng Rong, Jing Zhang, Ensheng Xu, Boyu Ying, Fanghu Zheng, Guangren Chai, Erci Xu, Yuanchao Su, Dennis Cai (Alibaba Cloud)
  • FlashCodec: Unleash All Decoding Resources for Low-Latency Video Decoding in MLLM Inference
    Lingxiao Zhao, Haoran Zhou, Yuezhi Che, Rongyu Luo (Wuhan University); Dazhao Cheng (WuHan University)
  • A^2: Characterizing and Mitigating Imbalanced Reclaim in MGLRU via Active Aging at Production Scale
    Fei Zeng (Central South University); Zicheng Wang, Ligeng Chen (Honor Device Co., Ltd); Yinggang Guo (Honor Device Co.,Ltd); Hao Wu (Nanjing University); Lu Liu, Tao Wang, Jun Xiao (Honor Device Co.,Ltd); Borui Li (Southeast University); Feng Lyu (Central South University)
  • Medivh: Harnessing Compatible and Accurate Sketch-based Network Measurement with Sparsity-based Virtualization
    Xiang Chen (Zhejiang University); Feng Zhu (Independent Researcher); Hongmin Tan, Jiayu Li, Jiashuo Yu, Longlong Zhu, Xingyuan Li, Yuchen Xian, Jiajie Su, Xingwei Lin, Qiang Wu, Chunming Wu (Zhejiang University)
  • Joseph: Hypervisor–RDMA Co-Design for Kernel-Bypass Remote MicroVM SnapStart
    Xingguo Pang (Unversity of Macau); Muhan Song, Chuang Hu, Kanye Ye Wang (University of Macau); Dazhao Cheng (WuHan University); Xiaobo Zhou (University of Macau)
  • Octopus: Unlocking SSD Parallelism for Sparse KV Cache Retrieval
    Tuowei Wang, Liyun Chu, Ruwen Fan, Ju Ren (Tsinghua University)
  • FM2: Fast Live VM Migration in CXL Memory Pools
    Zezhou Wang, Jonggyu Park (University of Washington); Shihang (Vic) Li (University of Washington; Google); Pedro Henrique Penna (Microsoft Research); Thomas E. Anderson, Simon Peter (University of Washington)
  • Efficient Training on Multiple Consumer GPUs with MovingPipe
    Yibin Luo, Shiwei Gao, Huichuan Zheng, Youyou Lu, Jiwu Shu (Tsinghua University)
  • MoE-Lego: A Plane-Grained System for Dynamic-Precision MoE Offloading
    Haozhe Wei, Xiaofeng Hou, Wenfeng Wang, Cheng Xu (Shanghai Jiao Tong University); Jiacheng Liu (Hong Kong University of Science and Technology); Chao Li, Minyi Guo (Shanghai Jiao Tong University)
  • Chorus: GPU–CPU Cooperative LLM Serving for Length-Skewed Decode
    Dong Chen, Yukun Zhou, Sheng Yao (Hong Kong University of Science and Technology); Ruichuan Chen (Nokia Bell Labs); Binhang Yuan, Shuai Wang (Hong Kong University of Science and Technology); Luping Wang, Cheng Huang, Guodong Yang, Liping Zhang (Alibaba Group); Wei Wang (Hong Kong University of Science and Technology)
  • IBTpoline: Flexible, Robust, and Intel IBT-compliant System Call Hooking
    Alexander J. Gaidis (Brown University); Ioulios Patmanidis (TU Delft); Isabelle Shapiro (Brown University); Georgios Portokalidis (IMDEA Software Institute); Alexios Voulimeneas (TU Delft); Vasileios P. Kemerlis (Brown University)
  • InfiniLoRA: Disaggregated Multi-LoRA Serving for Large Language Models
    Hongyu Chen, Letian Ruan (Shanghai Jiao Tong University); Zilin Xu (Bytedance); Yuchen Li (Singapore Management Univerisity); Xinyu Chen (The Hong Kong University of Science and Technology (Guangzhou)); Bingsheng He (National University of Singapore); Jingwen Leng, Jieru Zhao, Shixuan Sun, Minyi Guo (Shanghai Jiao Tong University)
  • Dasheng: LLM-powered Reliability Engineering Assistant for Cloud Overlay Networks
    Yining Qi (Zhejiang University); Chongrong Fang (Shanghai Jiao Tong University); Xiaoqing Sun (Alibaba Cloud); Tong Wu (Zhejiang University); Jiaxiang Chen (Shanghai Jiao Tong University); Xiaobo Xue (Alibaba Cloud); Shize Zhang (Alibaba Group); Xiaonan Shi, Yangyang Shi, Shuai Yang, Xiong Xiao (Alibaba Cloud); Peng Cheng, Jiming Chen (Zhejiang University); Biao Lyu (Alibaba Cloud)
  • BPFFoundary: Scalable and Practical Multi eBPF Program Composition and Testing at Meta.
    Prankur Gupta, Takshak Chahande, Miao Xu, Prashanth Kannan, Tejas Birajdar, Lilian Liu, Rajiv Krishnamurthy (Meta); Theophilus A. Benson (Carnegie Mellon University)
  • fRAC: Remote Accelerator Calls on FPGAs
    Ziyi Yang, Krishnan B. Iyer, Yixi Chen (KAUST); Ran Shu (Microsoft Research); Zsolt István (TU Darmstadt); Marco Canini, Suhaib Fahmy (KAUST)
  • Dynamic Analysis of Unsafe Rust: Behaviors and Benchmarks
    Jiaye Fang, Arsalan Bin Najeeb, Dylan O'Neill (The George Washington University); Prince Noah Johnson (University of Notre Dame); Zhixiao Zhang, Jie Zhou (The George Washington University)
  • RunaSan: A Rust-Native Sanitizer for Precise and Context-Sensitive Sanitization
    Jongyoon Kim, Kyuwon Cho, Hojoon Lee (Sungkyunkwan University)
  • REFlash: Reducing Total Endurance Cost in Flash-Based Tiering via Cross-Tier Write Balancing
    Sejun Kwon (Samsung Electronics and Seoul National University); Minwook Kim, Jin-Soo Kim (Seoul National University)
  • DAG-KV: DAG-Guided KV Propagation for Structure-Aware Knowledge Reuse
    Wenbin Zhu, Zhaoyan Shen, Qian Wei (Shandong University); Xin YAO, Xi Peng, Wei Zhang, Renhai Chen, Gong Zhang (Huawei Technologies Co., Ltd); Hongjun Dai, Dongxiao Yu, Shujian Zhao (Shandong University)
  • Flitter: Exploiting Voltage Glitches and Frequency Jitter to Create Cross-core Covert Channels on Modern CPUs
    Yucheng Ji (Tsinghua University); Chang Liu (National University of Singapore); Trevor E. Carlson (National University of Singapore, Google); Dongsheng Wang, Weidong Liu (Tsinghua University)
  • FLASH: Fault-Led, Attested, Secure Hybrid-Key Checkpoint for Confidential GPU
    Jonghyun Lee (University of Southern California); Taewoon Kang (Korea University); Pratheek B (NVIDIA); Yongqin Wang (Roblox); Rachit Rajat (NVIDIA); Mengyuan Li (USC); Gunjae Koo (Korea University); Daniel Wong (University of California, Riverside); Murali Annavaram (USC)
  • ELDR: Expert-Locality-Aware Decode Routing for PD-Disaggregated MoE Serving
    Sangjin Choi, Sukmin Cho (KAIST); Yifan Xiong (Microsoft Research); Ziyue Yang (Shanghai Xingyunzhili Artificial Intelligence Institute); Youngjin Kwon (KAIST); Peng Cheng (Microsoft Research)
  • BPF-Ext: Safely Extending the eBPF Compilation Pipeline with Native Operations
    Yusheng Zheng (UC Santa Cruz); Zhengjie Ji (Virginia Tech); weichen tao (Telecom Paris); Hao Sun (ETH Zurich); Wei Zhang (University of Connecticut); Dan Williams (Virginia Tech); Andi Quinn (University of California Santa Cruz)
  • MBCheck: Practical Static Analysis Framework for Detecting Memory Ordering Violations under WMM
    Jaidev Shastri, Binoy Ravindran (Virginia Tech)
  • RS-Infer: A Fast and Secure LLM Inference System for Mobile Devices with Recallable Resource Isolation
    Yinpeng Wu, Yitong Chen, Lixiang Wang, Jinyu Gu, Zhichao Hua, Yubin Xia (Shanghai Jiao Tong University)
  • KVLite: Efficient LLM Agent Scheduling via Head-Aware KV Sharing
    Jiaqi Si, Dezun Dong (National University of Defense Technology)
  • STRIDE: Efficient Secure Transformer Inference via Inter-Operator Protocol and Operator Co-Design
    Zhengyi Li (Shanghai Jiao Tong University); Yangjie Zhou (National University of Singapore); Zihan Liu, ZIYU XIAO (Shanghai Jiao Tong University); Kang Yang (State Key Laboratory of Cryptology); Jiaping Gui, Yu Feng, Yun Lin (Shanghai Jiao Tong University); Jin Song Dong (National University of Singapore); Yu Yu, Minyi Guo, Ning Liu, Jingwen Leng (Shanghai Jiao Tong University)
  • Towards Robust Cache Hits with Scalability via a Middle Layer Representing Workload Preferences
    Kunpeng Ding, Jiangping Han, Kaiping Xue, Qiangqiang Wei (University of Science and Technology of China)
  • AutoTailor: Automatic and Efficient Adaptive Model Deployment for Diverse Edge Devices
    Mengyang Liu (Southeast University); Chenyu Lu (The Hong Kong University of Science and Technology (Guangzhou)); Haodong Tian (Southeast University, Tsinghua University); Fang Dong, Ruiting Zhou (Southeast University); Wei Wang (HKUST); Dian Shen, Guangtong Li, Ye Wan (Southeast University); Li Li (University of Macau)
  • Astragalus: Automatic Configuration Repair for Production Networks
    Zhenrong Gu, Peng Zhang, Xing Feng, Xu Liu (Xi'an Jiaotong University)
  • SwiftMPC: Accelerating ML under MPC with Secure-Chip-Assisted One-Way Communication
    Tianze Song, Chengkun Wei (Zhejiang University); Yichen Tu, Yangming Zhang, Heng Cai, Haiyuan Gao (Alibaba Cloud); Yuyang Cui (Tianjin University); Minghong Tang, Jin Shi, Tong Chen, Yin Zhang (Zhejiang University); Wei Wang (Alibaba Group); Wenzhi Chen (Zhejiang University)
  • Requests of a Feather Must Flock Together: Batch Size vs. Prefix Homogeneity in LLM Inference
    Saksham Rathi, Preeti, Mythili Vutukuru (Indian Institute of Technology Bombay)
  • Rocks, Pebbles and Sand: Modality-aware Scheduling for Multimodal Large Language Model Inference
    Konstantinos Papaioannou, Thaleia Dimitra Doudali (IMDEA Software Institute)
  • Detecting API Misuses Across Context Boundaries in Linux Kernel Drivers
    Thomas Fourier, Julia Lawall, Baptiste Lepers (Inria)
  • JetFire: Approximate-then-Correct Attention on Hybrid Memory for Long-Context LLM Inference
    Feng Yu, Hongshi Tan (National University of Singapore); Yao Chen (Huazhong University of Science and Technology); Gustavo Alonso (ETH Zürich); Weng-Fai Wong, Bingsheng He (National University of Singapore)
  • Energy-Aware Scheduling for Serverless LLM Serving on Shared GPUs
    Tianyu Wang (University of Pittsburgh); Gourav Rattihalli, Aditya Dhakal (HPE Labs); Longfei Shangguan (University of Pittsburgh & Google); Dejan Milojicic (HPE Labs)
  • Cloudless Tomorrow: A Memory-Centric System for Self-Improving Device-Cloud LLM Agents
    Zeyu Qiu, Yaohui Wang, Shuyi Wang (Huazhong University of Science and Technology); Yu Kuang (School of Computer Science and Technology Huazhong University of Science and Technology); Qinbin Li, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology)
  • UBASE: An AI Search Engine for Trillion-Scale Vector Data Management
    Yao Tian, Yuncheng Lu, Liyao Xiong (Bytedance); Yuming Xu (ByteDance); Hao Zhang, Weichen Zhao (Bytedance); Xi Zhao, Bo Kuang, Dongyu Wang, Jiehui Li, Yakun Li, Lei Zhang (ByteDance)
  • DiGiT: Co-Designing GNN Algorithms and Storage I/O for Out-of-Core Training Acceleration
    Qian Wei (Shandong University); Yi Li (The University of Texas at Dallas); Junchi Ren, Zehao Chen, Zhaoyan Shen, Dongxiao Yu (Shandong University); Bingzhe Li (University of Texas at Dallas)
  • Axon: Asynchronous Global KV-Aware Scheduling Across Distributed Instances for Agentic Workloads
    Yuqi Qiu, Jinting Zou (University of Macau); Zizhao Mo (Great Bay University and University of Macau); Junlin Chen (University of Macau); Liao Chen (University of Macau, Macau SAR, China); Huanle Xu (University of Macau); Guoyao Xu, Guodong Yang, Liping Zhang (Alibaba Group); ChengZhong Xu (University of Macau)
  • Understanding and Detecting Atomicity Violation Bugs in Distributed Database Transaction Mechanisms
    Zhiyong Wu (School of Software, Tsinghua University); Jie Liang (Beihang University); Jingzhou Fu, Chi Zhang (Tsinghua University); Heyuan Shi (Central South University); Yu Jiang (Tsinghua University)
  • Hardening Programs with Data Value Space Randomization of Semantically Arbitrary Values
    Jaeyoon Kim, Hajeong Lim, Kyuwon Cho, Hojoon Lee (Sungkyunkwan University)
  • Everything you always wanted to know about RDMA-based distributed Key-Value Stores
    Paul Breuil (Inria and University of Sydney); Sumit Kumar Monga, Baptiste Lepers (Inria)
  • BMV: Breaking Monolithic Verification for Fast Speculative LLM Inference
    Dongxu Liu, Bing Zhu, Xinyu Zhu, Long Zheng, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology); Jingling Xue (UNSW Sydney)
  • PrefixFlow: Training-Time KV Caching for Schedule-Level Prefix Reuse in LLM RL Training
    Pengbo Li, Feiyuan Zhang (Hong Kong University of Science and Technology); Guangming Sheng (Tencent); Guangxin He (Hong Kong University of Science and Technology); Di Chai (Shanghai University of Finance and Economics); Ziniu Li (Tencent); Taiqiang Wu (The University of Hong Kong); Han Tian (The University of Science and Technology of China); Wenyu Mao (Tencent); Binhang Yuan, Kai Chen (Hong Kong University of Science and Technology)
  • Fuzz Testing on IPC Based OS Services with Resource State Awareness
    Yuheng Shen, Yifei Chu (Tsinghua University); Fan Ding (Central South University); Jianzhong Liu (Tsinghua University); Qiang Zhang (Jiangxi University of Finance and Economics); Heyuan Shi (Central South University); Yu Jiang (Tsinghua University)
  • IgniteServe: Accelerating LLM Serving Engine Cold Starts via Fine-Grained Parallelization
    Wenbiao Cao, Hang Huang (Huazhong University of Science and Technology); Jia Rao (The University of Texas at Arlington); Zhuo Huang, Song Wu, Hai Jin (Huazhong University of Science and Technology)
  • SubSan: Efficient Memory Error Detection via Subtraction Checks
    Jeonghwan Kang, Kyounghwan Kim, Donghyun Kwon (Pusan National University)
  • Make Graphs Great Again: Rethinking LLM Agent Architecture via Structure-Semantic Separation
    Jingyi Jia, Jiale Wang, Haoyi Zhang, Qinbin Li, XIAOFEI LIAO, Hai Jin (Huazhong University of Science and Technology)
  • Demystifying the Performance of Kernel-Bypass TCP Stacks
    Minhu Wang, Mingwei Xu, Jianping Wu (Tsinghua University)
  • Understanding and Detecting Performance Regressions in Modern Open-Source Server Applications
    Jinze Si (Shanghai Jiao Tong University); Xiaoqian Ma (Shanghai JiaoTong University); Mingyu Wu, Haibo Chen (Shanghai Jiao Tong University)
  • Skip it, don't speed it. Accelerating Graph Pattern Matching through Disjoint Intersection Bypassing
    Haotian Ma, Wei-Chung Hsu, Yeh-Ching Chung (The Chinese University of Hong Kong, Shenzhen)
  • HKVQ: Homomorphic KV Quantization for Disaggregated LLM Inference
    Zeyu Zhang, Haiying Shen (University of Virginia); Shay Vargaftik (VMware Research); Ran Ben Basat (University College London); Michael Mitzenmacher, Minlan Yu (Harvard University)
  • MoECatch: Efficient Checkpointing and Consistent Recovery for Mixture-of-Experts Models
    Guorui Xu, Xiang Liu (Southeast University); Weiwei Wu (Southeast university, P. R. China); Keni Qiu (Capital Normal University); Guang Kou (Defense Innovation Institute); Chenchen Fu (Southeast University); Jianping Wang (City University of Hong Kong)
  • Unipool: Efficient Management of Pre-Provisioned Resources for Container Platforms
    Hanfei Yu (Stevens Institute of Technology); Enrique Saurez, Íñigo Goiri (Microsoft Azure Research - Systems); Hao Wang (Stevens Institute of Technology); Rodrigo Fonseca (Microsoft Azure Research - Systems)
  • Courier: Host-Transparent Direct Network I/O for Secure Containers in Cloud VMs
    Hang Huang, Zhucan Ye (Huazhong University of Science and Technology); Zhiheng Tao (Ant Group); Hui Lu (The University of Texas at Arlington); Wenlong Hou (Ant Group); Wei Guo, Quan Xu, Jiang Liu (Alibaba Group); Jiangshan Lai (Ant Group); Jia Rao (The University of Texas at Arlington); Zhuo Huang, Song Wu, Chen Yu, Hai Jin (Huazhong University of Science and Technology)
  • SeaStore: Redesigning Ceph’s Storage Backend for CPU-Efficient NVMe Performance
    Myoungwon Oh (Korea Aerospace University); Yingxin Cheng (DDN); Matan Breizman, Josh Durgin (IBM)
  • Breaking Host-Wide Blocking: Boundary-Closure SCSI Error Handling
    Dongdong Hao (Xiamen University); Ye Xu (LeapIO Inc.); Jiazheng Zhang (Xiamen University); Xiaoyang Wang, Shuo Wang (LeapIO Inc.); Jiwu Shu (Xiamen University)
  • EvoFuzz: IR-Aware Fuzzing for JIT Compilers through the Lens of Node Evolution
    Jinze Si (Shanghai Jiao Tong University); Yuchen Sun (parissun@sjtu.edu.cn); Mingyu Wu, Haibo Chen (Shanghai Jiao Tong University)
  • SplineFS: Adaptive Learned Directory Indexing for Memory-Constrained Filesystems
    Jianqaing Zeng, Shaocong Sun (Peking University); Chengying Huan (Nanjing University); Peng Wang (Huazhong University of Science and Technology); Ke Zhou (Huazhong University of Science and Technology (HUST)); Yingwei Luo, Xiaolin Wang (Peking University); Zhenlin Wang (Michigan Tech); Diyu Zhou (Peking University); Yingdi Shan (Tsinghua University); Jie Zhang (Peking University)
  • XCG: Decoupling Control from Configuration to Improve Cgroup Scalability with Flat Mapping
    ruofan xiong (Xiamen University); Li Wang (KylinSoft); Zhihao Zhang (Tsinghua University); Xinbiao Gan (NUDT & HUST); Yiming Zhang (Shanghai Jiao Tong University)
  • Premature Hardware Binding is the Root of all Evil! Making Serverless Performance-Portable with Lazy Hardware Binding
    Serhii Ivanenko (INESC-ID, Instituto Superior Técnico, University of Lisbon); Carlos Segarra (Imperial College London); Rodrigo Bruno (INESC-ID, Instituto Superior Técnico, University of Lisbon)
  • FlexMARL: Graph-Driven Rollout-Training Co-Design for LLM-Based Multi-Agent Reinforcement Learning
    Zhida Jiang, Zhaolong Xing, Jiawei Lu (JD.com); Yipei Niu (Huawei); Qingyuan Sang, Liangxu Zhang (JD.com); Wenquan Dai (Huawei); Junhua Shu, Jiaxing Wang (JD.com); Qiangyu Pei, Qiong Chen, Xinyu Liu (Huawei); Fangming Liu (Huazhong University of Science and Technology); Ai Han, Zhen Chen, Ke Zhang (JD.com)
  • EntangledEdge: Orbital Quantum Sensing and Learning as a New Class of Distributed Systems
    Mohammad Abrarul Hasanat, Amit Samanta (University of Utah); Jason Ludmir, Tirthak Patel (Rice University); Rohan Basu Roy (University of Utah)
  • Storage Evolution for Exascale Supercomputers: Lessons from Sunway TaihuLight to OceanLight
    Bin Yang, Cheng Su (Tianjin University); Hao Wei (Tsinghua University); Wenze Du, Jiwei Yan, Shihan Zhang (Tianjin University); Wei Xue (Tsinghua University); Ce Yu (Tianjin University)
  • Bypassing Android System Services for Fast UI Responsiveness: A Kernel-Application Co-Design Approach
    Zizhan Chen (The Chinese University of Hong Kong); Renhai Chen (Huawei Technologies Co., Ltd); Zili Shao (The Chinese University of Hong Kong)
  • Plurio: Scaling Microkernel-based Operating System via Service Localization and Memory Pooling
    Zhenlin Qi, Shengan Zheng, Bowen Zhang, Linpeng Huang (Shanghai Jiao Tong University)
  • Beyond Target Placement: Unified Multi-Objective Path-Aware Offline VM Scheduling at Scale
    Zihan Xu, Zhidong Hu, Zhengtong Zhang, Fei Peng, Kaiyuan Shen, Feng Wang, Xiangyun Kong, Binda Ma, Jian Zhou (Alibaba Cloud Computing)
  • EMDedup: Accelerating DLRM via In-Network EMbedding Layer Deduplication
    Wenjie Li (SKLP, Institute of Computing Technology, Chinese Academy of Sciences; Zhengzhou University); Ke Liu, Zhao Zhang (SKLP, Institute of Computing Technology, Chinese Academy of Sciences); Ning Liu, Hui Yuan, Zixuan Guan, Xiaolong Zheng (Huawei); Xu Zhang, Kefan Liu (SKLP, Institute of Computing Technology, Chinese Academy of Sciences); Guanghui Zhang (Shandong University); Yungang Bao (ICT, CAS); Mingyu Chen (SKLP, Institute of Computing Technology, Chinese Academy of Sciences); Chenxi Wang (SKLP, Institute of Computing Technology, CAS; University of Chinese Academy of Sciences)
  • Cold-Patching for Faster Edit-Compile-Run Cycles
    Matthew Sotoudeh (Stanford University)
  • FDP-Rocks: An Effective Use Case of FDP in RocksDB
    Jian Zhou (University of Texas at Arlington); Inho Song (Virginia Tech); Chen Zhong (University of texas at arlington); Peiran Du, Lingfeng Xiang (The University of Texas at Arlington); Sam H. Noh (Virginia Tech); Wenguang Wang (Broadcom Inc.); Jia Rao (The University of Texas at Arlington); Song Jiang (University of Texas at Arlington)
  • HYPIC: Position-Independent Caching for Hybrid-Attention LLM Serving
    Yifei Liu (Xiaohongshu Inc.); Juntong Wu (Peking University); Yang Liu (Shanghai Jiao Tong University); Junhao Hu (Peking University); Minghao Li, Xiaoxu Chen, Weihang Chen (Xiaohongshu Inc.)
  • CoreCapture: Anomaly-Aware System Trace Sampling for Resource-Constrained Mobile Devices
    Yongqian Sun, Xiaotian Wang, Yicheng Sui, Jintao Feng, Yue Zhang, Shenglin Zhang (Nankai University); Bowen Zheng, Qiang Li, Wei Liang (Huawei); Dan Pei (Tsinghua University)
  • Rattan: An Extensible and Scalable Modular Internet Path Emulator
    Yixin Shen, Minhu Wang, Bo Wang, Haixuan Tong, Chenghao Li, Yutong Xie, Yixuan Gao, Mingwei Xu, Jianping Wu (Tsinghua University)
  • AccFS: An Accelerator-Aware File System for Non-Volatile Memory
    Sangjin Lee, Taehwan Ahn, Yongseok Son (Chung-Ang University)
  • brg-pk: A Practical Verified High-Throughput Kernel Lock for OpenBSD
    David Gwynne, Robert Colvin (University of Queensland); Brijesh Dongol (University of Surrey); Roger Su (Australian National University); Daniel Wright (University of Surrey)
  • HybridQC: Hardware-Grounded Simulation of Tightly Integrated Hybrid Quantum-Classical Systems
    Panayiotis Christou, Shuwen Kan, Ying Mao (Fordham University)
  • ESROS2: Application Sandboxes for Secure ROS2
    Dev Tejas Gandhi, Vinod Ganapathy (Indian Institute of Science Bangalore)
  • Resi-DINC: Resilient Distributed In-Network Computing with Closed-Loop Runtime Assurance
    Xiaoying Huang, Kun Huang, Mengqian Pang (Pengcheng Laboratory)
  • Spectra: Bandwidth-Faithful Data Placement for Tiered Memory
    Jiahui Zhang, Qiang Cao (Huazhong University of Science and Technology); Hong Jiang (UT Arlington)
  • Towards High-Throughput Collective Communication via Harnessing PCIe and Dedicated Interconnects
    Yuezheng Liu, Menghao Zhang, Xuebin Song, Juner Shen, Chunming Hu, Xudong Liu (Beihang University)
  • Efficient Strict Serializability for Stateful Serverless Workflows via Workflow Reconciliation
    Shenghao Ao (Shanghai Jiao Tong University); Zijun Li (Department of Computer Science and Engineering, Shanghai Jiao Tong University); Chuhao Xu, Quan Chen (Shanghai Jiao Tong University); Shuo Quan (Cloud Computing Research Institute, China Telecom); Yanan Yang (China Telecom Cloud Computing Research Institute); Jie Wu (Temple University, China Telecom Cloud Computing Research Institute); Meiqi Zhu, Yujun Wang (China Telecom Cloud Technology Co., Ltd.); Minyi Guo (Shanghai Jiao Tong University)
  • Schedules Are Solvable Symbols: Tuning-Free Compilation of Tile Programs on Dataflow Architectures
    Heru Wang, Zhenyu Bai, Wei Li, Tulika Mitra (National University of Singapore)
  • EBFuzz: Breaking Hidden Structural Assumptions in Compilers via Extended Assembly Injection
    Jiangchang Wu, Yibiao Yang (State Key Laboratory for Novel Software Technology, Nanjing University)
  • HeadFlow: Scaling Long-Context Training with Head-Group Activation Residency
    Yixin Song, Jianxiang Gao (Shanghai Jiao Tong University); Shuhuai Zhang (Zhejiang University); Zeyu Mi, Haibo Chen (Shanghai Jiao Tong University)
  • Lightweight Memory Tracing via General Binary Analysis and Offline Reconstruction
    Ziheng Liu, Steven Swanson (University of California, San Diego)

Note: For each accepted paper, at least one author must have a full (non-student) registration.