Schedule

Tuesday, 29 September

08:00 Registration desk opens
08:30 – 10:00
Workshops
https://sigops.org/s/conferences/sosp/2026/workshops.html
10:00 – 10:30 Coffee break
10:30 – 12:00
Workshops
https://sigops.org/s/conferences/sosp/2026/workshops.html
12:00 – 13:30 Lunch break
13:30 – 15:00
Workshops
https://sigops.org/s/conferences/sosp/2026/workshops.html
15:00 – 15:30 Coffee break
15:30 – 17:30
Workshops
https://sigops.org/s/conferences/sosp/2026/workshops.html

Wednesday, 30 September

08:00 Registration desk opens
08:30 – 08:50 Opening remarks
08:50 – 10:10
Session 1AModel Serving at Scale
Chair: Shivaram Venkataraman (University of Wisconsin -- Madison)
  • Janus: Multi-LLM Serving at Production Scale
    Tianbao Zhou (Peking University), Yi Wang (JD Company), Yu Zhou (UCAS), Zirui Liu, Zhiming Wang, Yebo Peng (Peking University), Yongfu Wang (USTC), Yi Zhang, Jinrun Yin, Kemeng Tian (Peking University), Fangcheng Fu (SJTU), Tongxuan Liu, Tao Peng (JD Company), Tong Yang, Bin Cui, Xupeng Miao (Peking University), Ke Zhang (JD Company)
  • SANDHI: Fine-grained Merging for Memory Efficient Multi-Model Serving
    Vima Gupta, Oytun Kuday Duran, Nandan Suresh Meda, Ikhyun An (Georgia Institute of Technology), Ganesh Ananthanarayanan (Microsoft), Anand Iyer (Georgia Institute of Technology)
  • Batched in Back: Characterizing and Optimizing Offline LLM Inference in Production with ACDC
    Leping Yang (Shanghai Jiao Tong University and Alibaba Group), Xue Li, Kun Qian (Alibaba Group), Erci Xu (Shanghai Jiao Tong University), Mingzhen Han, Haoran Zhu, Tao He, Zuolong Yin, Ennan Zhai, Wenyuan Yu, Jingren Zhou (Alibaba Group), Guangtao Xue (Shanghai Jiao Tong University)
  • Taming Inference Workloads at Global Scale: Foundation Model Serving in Amazon Bedrock
    Pratik Pankaj Raichura, Somu Perianayagam, Rama Krishna Sandeep Pokkunuri, Divya Jain (Amazon Web Services)
  • Beyond Utilization: Energy-Conscious GPU Sharing for Inference Serving
    Prasoon Sinha, Dimitrios Liakopoulos, Nathan Lemma, Neeraja J. Yadwadkar (The University of Texas at Austin)
10:10 – 10:40 Coffee break
10:40 – 12:00
Chair: Emmett Witchel (The University of Texas at Austin)
  • Big Bird: Resilient Privacy Budgeting Across Untrusted Web Domains
    Pierre Tholoniat, Alison Caulfield, Giorgio Cavicchioli, Mark Chen (Columbia University), Benjamin Case (Meta Inc.), Asaf Cidon, Roxana Geambasu (Columbia University), Mathias Lécuyer (University of British Columbia), Martin Thomson (Mozilla)
  • Cohort: Decentralized PIR
    Jonathan Weiss, Yossi Gilad (The Hebrew University of Jerusalem)
  • CryptDough: A unified analytics engine for secure multiparty computation
    Muhammad Faisal, Alessandra Lanz, Sam Buxbaum, Adam Godel, Vasiliki Kalavri, Mayank Varia, John Liagouris (Boston University)
  • DISCO*: DIstributed and SCalable Oblivious Joins and Oblivious Primitives
    Apostolos Mavrogiannakis (University of California, Santa Cruz), Xian Wang (Hong Kong University of Science and Technology), Ioannis Demertzis (University of California, Santa Cruz), Dimitrios Papadopoulos (Hong Kong University of Science & Technology), Minos Garofalakis (ATHENA Research Center & Technical University of Crete)
  • Cerium: A Multi-GPU Framework for Terabyte-Scale Encrypted Inference
    Siddharth Jayashankar (Carnegie Mellon University), Joshua Kim (University of Texas at Austin), Michael B. Sullivan (NVIDIA), Wenting Zheng, Dimitrios Skarlatos (Carnegie Mellon University)
12:00 – 13:30 Lunch break
13:30 – 15:10
Session 1CCXL and Memory Systems
Chair: Sara McAllister (University of Wisconsin -- Madison)
  • Borges: A Low-Latency Distributed Shared Log on a CXL Memory/SSD Hybrid
    Haowei Chen, Yiming Xiang (The University of Texas at Austin), Zhipeng Jia (Anthropic PBC), Yan Sun, Nam Sung Kim (UIUC), Emmett Witchel (The University of Texas at Austin)
  • Disk-Based LSMs: An Unexpectedly Good Index for Partly Coherent CXL Memory
    Kiran Hombal, Jiyu Hu (University of Illinois Urbana-Champaign), Marcos K. Aguilera (NVIDIA), Ramnatthan Alagappan, Aishwarya Ganesan (University of Illinois Urbana-Champaign)
  • StarfishOS: Revisiting Single System Image on CXL with State-partitioned Microkernel
    Fangnuo Wu (Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University), Jingsheng Yan, Mingkai Dong, Wenjun Cai (Shanghai Jiao Tong University), Jingwei Xu (Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University), Tong Xin, Haibo Chen (Shanghai Jiao Tong University)
  • XTRA: Unifying Cache Coherence and Concurrency Control for Distributed Transactions in a CXL Pod
    Zhijun Yang, Yu Hua, Ming Zhang, Menglei Chen, Xumin Chen, Aoyang Tong (Huazhong University of Science and Technology)
  • Scheduling Linux Threads under I/O Chiplet Wall Using cSwitch
    Seunghyun An, Joontaek Oh, Ming Liu (University of Wisconsin-Madison)
  • Tierce: Observability-Driven Tiered Memory Management for Colocated Workloads
    Hanchen Xu, Berkay Inceisci, Hao Li, Zhenyu Zhang, Huaicheng Li (Virginia Tech)
15:10 – 15:40 Coffee break
15:40 – 17:30
Chair: Hayley LeBlanc (Microsoft Research)
  • GAZE: Rearchitecting Log-Structured Filesystem for Garbage Collection on Zoned Namespace Flash Storage
    Juwon Kim, Hwanseok Yoo, Seung Won Yoo (KAIST), Youjip Won (Korea Advanced Institute of Science and Technology)
  • ProbeFS: Hierarchical DNA File Systems via Biochemical Content Addressability and Parallelism
    Ruihan Li, Yuankun Zhang, Mingkai Dong, Yaya Hao, Fei Wang, Chunhai Fan, Haibo Chen (Shanghai Jiao Tong University)
  • Don't Let AI Agents YOLO Your Files: Information and Control in Agent-Native Filesystems
    Shawn (Wanxiang) Zhong, Junxuan Liao (University of Wisconsin-Madison), Jing Liu (Microsoft Research), Mai Zheng (Iowa State University), Andrea Arpaci-Dusseau (University of Wisconsin-Madison), Remzi Arpaci-Dusseau (University of Wisconsin–Madison)
  • TensorDex: A Compact, Tensor-Centric Storage System for Modern AI Models
    Tingfeng Lan, Zirui Wang (University of Virginia), Yunjia Zheng (Harvard University), Zhaoyuan Su (University of Virginia), Juncheng Yang (Harvard University), Yue Cheng (University of Virginia)
  • VoliStorM: A Crash-Consistent I/O Cache with Two Kernels Instead of Two Caches
    Jana Toljaga, Nicolas Derumigny, Tara Aggoun, Mathieu Bacou, Gaël Thomas (Samovar, Inria, Télécom SudParis, Institut Polytechnique de Paris)
  • AgileLog: A Forkable Shared Log for Agents on Data Streams
    Shreesha G. Bhat, Tony Hong, Michael A Noguera, Aishwarya Ganesan, Ramnatthan Alagappan (University of Illinois Urbana-Champaign)

Thursday, 1 October

08:00 Registration desk opens
08:30 – 10:10
Chair: Malte Schwarzkopf (Brown University)
  • Computation is Fast, Use Threadlet!
    Yiming Yao, Xiaohe Qin (Peking University and Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC)), Yi Fan (Peking University), Yuanlong Li (EPFL), Kang Hu, Liujia Li (Peking University), Xiaolin Wang, Tao Xie (Peking University and Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC)), Zhenlin Wang (Michigan Technological University), Yuval Tamir (UCLA), Yingwei Luo, Diyu Zhou (Peking University and Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC))
  • It's the Kernel's Fault! Custom Page Fault Handling With bpf_fault
    Tal Zussman, Riju Dey, Hasan Zengin, Yiming Fang (Columbia University), David Hildenbrand (Technical University of Munich and Arm Germany GmbH), Asaf Cidon (Columbia University)
  • MCon: Building an Elastic Cloud for Android Applications with Framework Consolidation
    Jiaxing Qiu, Zijie Zhou, Zhenhua Li, Hongyi Wang, Zizhang Liu, Yunhao Liu (Tsinghua University), Yumeng Liang (China Telecom Cloud Computing Research Institute), Jie Wu (China Telecom Cloud Computing Research Institute & Temple University), Wen Xia (Harbin Institute of Technology, Shenzhen), Tianyin Xu (University of Illinois Urbana-Champaign)
  • Skill VM: Write Once, Run Everywhere Efficiently
    Le Chen, Erhu Feng, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University)
  • Turning Linux into a High-Performance Library OS with Flux
    Kaifu Tian, Youjie Zheng, Yiren Zhang, Yuyang You, Keyang Hu (Tsinghua University), Kang Chen (Peking University, Tsinghua University), Yu Chen (Tsinghua University)
  • You Can Always Get What You Want: CPU Virtualization Made Fast and Free
    Yun Wang (Shanghai Jiao Tong University), Xingguo Jia, Ben Luo, Kenan Liu, Shengdong Dai, Jingdong Han, Weihao Chen (Alibaba Group), Xingzi Yu, Chenggang Wu (Shanghai Jiao Tong University), Yibin Shen, Jiesheng Wu (Alibaba Group), Tao Song, Zhengwei Qi, Haibing Guan (Shanghai Jiao Tong University)
10:10 – 10:40 Coffee break
10:40 – 12:00
Chair: Yubin Xia (Shanghai Jiaotong University)
  • DiFlow: A System for Micro-Serving Text-to-Image Diffusion Workflows
    Lingyun Yang (Hong Kong University of Science and Technology & Alibaba Group & Shanghai Jiao Tong University), Suyi Li, Tianyu Feng, Xiaoxiao Jiang (Hong Kong University of Science and Technology), Zhipeng Di, Weiyi Lu, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang (Alibaba Group), Wei Wang (Hong Kong University of Science and Technology)
  • LMTracer: Fine-Grained and Real-Time Performance Profiling for Production LLM Systems
    Wei Liu (Rank Computing and Tsinghua University), Yongchao He, Bohan Zhao, Hongyi Wang, Zhenhua Li (Tsinghua University), Junping Zhao (Rank Computing)
  • Scalable Context Orchestration for Serving LLMs Over Voice
    Linyi Jiang (Shanghai Jiao Tong University, AgenticSys), Silvery D. Fu (AgenticSys), Yifei Zhu (Shanghai Jiao Tong University)
  • TuxBot: Semantic-Aware Online OS Tuning with LLMs
    Georgios Liargkovas, Mihir Nitin Joshi (Columbia University), Hubertus Franke (IBM Research), Kostis Kaffes (Columbia University)
  • StreamEP: Straggler-Tolerant MoE Decoding without Communication Barriers
    Yizhuo Liang, Shaoyu Wang (University of Southern California), Jaeyong Song (Seoul National University), Yanqi Zhou (Google DeepMind), Geon-Woo Kim (The University of Texas at Austin), Guangrong He, Seo Jin Park (University of Southern California)
12:00 – 13:30 Lunch break
13:30 – 15:10
Chair: Nickolai Zeldovich (MIT)
  • I3DP: Neuro-symbolic Inductive Invariant Inference for Distributed Protocols
    Weining Cao, Guangyuan Wu, Yuan Yao (Nanjing University), Hengfeng Wei (Hunan University), Taolue Chen (Birkbeck, University of London), Xiaoxing Ma (Nanjing University)
  • Lion: Modular Verification of Async Runtime Liveness
    Ti Zhou, Zihao Zhang, Omar Chowdhury, Shuai Mu (Stony Brook University)
  • Sockeye: Bug-finding and proofs for platform configurations and hardware based on reference manuals
    Ben Fiedler, Sedan Abdelgawad, Teymour Aldridge, Viktor Fukala, Jan Häussermann, Gamal Hassan, Lars Leuthold, Konstantin Lucny, Max Wierse, Samuel Gruetter, Timothy Roscoe (ETH Zurich)
  • Verifying a high-performance distributed transaction system using permissioned state machines
    Yun-Sheng Chang (MIT), Joseph Tassarotti (New York University), Frans Kaashoek, Nickolai Zeldovich (MIT)
  • Validating a Production Cloud Object Store with Lightweight Formal Methods
    Vimuth Fernando, Rajeev Joshi, Bernhard Kragl (Amazon Web Services), Julien Mascart (Meta), Matthew Russo, Sarek Skotåm, Colin Walker, Jake Wires (Amazon Web Services)
  • Welder: Compositional Liveness Verification of Cluster Control Planes
    Zhizhen Cathy Cai, Nikhil Date, Jiawei Tyler Gu (University of Illinois Urbana-Champaign), Cody Rivera, Tej Chajed (University of Wisconsin-Madison), Oded Padon (Weizmann Institute of Science), Tianyin Xu (University of Illinois Urbana-Champaign), Xudong Sun (University of Toronto)
15:10 – 15:40 Coffee break
15:40 – 16:40
Session 2DStudent Research Competition Talks (60 mins)
Chairs: Michal Friedman and Ana Klimovic
16:45 – 17:30 Invited talks from TOCS (45 mins)
  • CCKit: An Open-Source Toolkit for Cache Coherent Accelerators
    Abishek Ramdas, David Cock, Michael Giardino, Dario Korolija, Anastasiia Ruzhanskaia, Daniel Schwyn, Adam Turowski, Gustavo Alonso, Timothy Roscoe (ETH Zürich)
  • EIDS: A Cloud Intrusion Detection System with HighPerformance and Maintainability
    Xiaokang Hu (Alibaba Group), Zhichao Hua (Shanghai Jiao Tong University), Naixuan Guan, Yun Xu, Yibin Shen (Alibaba Group), Yang Yu, Zeyu Mi, Yubin Xia (Shanghai Jiao Tong University), Ming Wang, Jiesheng Wu (Alibaba Group)
  • Making Hardware Features Bespoke: Operating SystemSupport for Bes-Mode Processes
    Bicheng Yang, Yuanpei Wu, Rongchuan Liu, Dong Du, Yubin Xia, Binyu Zang, Haibo Chen(Institute of Parallel and Distributed Systems, Shanghai Jiaotong University)

Friday, 2 October

08:00 Registration desk opens
08:30 – 10:10
Session 3ADistributed systems
Chair: Rodrigo Rodrigues (Instituto Superior Técnico [ULisboa] / INESC-ID)
  • PirateShip: Append-Only Ledgers for (Mostly) Trusted Execution Environments
    Shubham Mishra (University of California, Berkeley), João Gonçalves (INESC-ID & IST U. Lisboa), Chawinphat Tankuranand, Natacha Crooks, Neil Giridharan (UC Berkeley), Heidi Howard, Chris Jensen (Azure Research, Microsoft)
  • DDB: Source-Level Interactive Debugging for Distributed Applications
    Yibo Yan, Junzhou He, Seo Jin Park (University of Southern California)
  • Sintr: Safe Interactive Transactions in the Presence of Byzantine Clients
    Austin T. Li, Daniel H. Lee, Lorenzo Alvisi (Cornell University), Natacha Crooks (UC Berkeley), Florian Suri-Payer (Cornell University / Databricks)
  • Smaran: Serving Authenticated Time Travel Queries
    Asim Nepal, Shistata Subedi (University of Oregon), Shubham Mishra (University of California, Berkeley), Suyash Gupta (University of Oregon), Aniket Kate (Purdue University), Hein Meling (University of Stavanger)
  • RPCShield: Defending Microservices Against Cascading Failures
    Milind Chabbi, Sonal Mahajan (Uber Technologies), Ivan Beschastnikh (University of British Columbia), René Just (University of Washington), Yuxin Wang, Yufan Xu (Uber Technologies), Elton Pinto (Georgia Institute of Technology), Seemanta Saha (Uber Technologies), Manu Sridharan (University of California, Riverside), Abhishek Jha, Sandeep Koushik Sheshadri, Mayank Bansal (Uber Technologies)
  • QProf: Fleetwide Transitive Cost Profiling of Warehouse-Scale Services
    Sam (Likun) Xi, Alexey Alexandrov, Ali Sheikh, Ning Wang, Vance Lankhaar, Tipp Moseley, Parthasarathy Ranganathan (Google)
10:10 – 10:40 Coffee break
10:40 – 12:00
Chair: Peter Pietzuch (Imperial College London)
  • Anchor: Mitigating GPU Shallow Disruptions with Decoupled Memory
    Haoyi Ma, Shiwei Gao (Tsinghua University), Youmin Chen (Shanghai Jiao Tong University), Junrong Huang, Youyou Lu, Jiwu Shu (Tsinghua University)
  • Linux AGX: An Adaptive GPU eXtension to Linux Fair Scheduling for Physical AI and Robotic Systems
    Soheil Shirvani, Cong Liu (University of California - Riverside)
  • TensorHub: Scalable and Elastic Weight Transfer for LLM RL Training
    Chenhao Ye (University of Wisconsin–Madison), Huaizheng Zhang, Mingcong Han, Baoquan Zhong, Xiang Li, Qixiang Chen, Xinyi Zhang, Weidong Zhang, Kaihua Jiang, Wang Zhang, Sun He, Wencong Xiao (ByteDance Seed), Andrea Arpaci-Dusseau, Remzi Arpaci-Dusseau (University of Wisconsin–Madison)
  • A Few GPUs, A Whole Lotta Scale: Faithful LLM Training Emulation with CrystalLLM
    Shaoke Xi, ChonLam Lao (Alibaba Group), Boyi Jia (Shanghai Jiao Tong University and Alibaba Group), Jiaqi Gao, Zhipeng Zhang, Jiamin Cao (Alibaba Group), Brian Sutioso (Harvard University), Erci Xu (Shanghai Jiao Tong University), Minlan Yu (Harvard University), Kui Ren (Zhejiang University), Yong Li, Zhengping Qian, Ennan Zhai, Jingren Zhou (Alibaba Group)
  • LLM-42: Enabling Determinism in LLM Inference with Verified Speculation
    Raja Gond (Microsoft Research), Aditya K Kamath (University of Washington), Ramachandran Ramjee, Ashish Panwar (Microsoft Research)
12:00 – 13:30 Lunch break
13:30 – 15:10
Chair: Andi Quinn (University of California Santa Cruz)
  • Ahead-of-time Analysis of Shell Program Effects
    Lukas Lazarek, Evangelos Lamprou, George Kapetanakis, Anirudh Narsipur, Eric Zhao, Zhiwen Zheng (Brown University), Michael Greenberg (Stevens Institute of Technology), Konstantinos Kallas (University of California, Los Angeles), Nikos Vasilakis (Brown University)
  • Testing Custom Control Planes Without the Cluster
    Tim Goodwin, Lindsey Kuper, Andi Quinn (University of California, Santa Cruz)
  • On-site, Non-speculative Failure Diagnosis with CLODS
    Rishikesh Devsot (YScope); Yi Fan Yu (University of Toronto); ChenXing Yang (University of Toronto and YScope); Ellen Shi (University of Toronto); Ding Yuan (University of Toronto and YScope)
  • State-Aware Fuzzing of JavaScript Engines with LLM-Guided Instrumentation
    Wai Kin Wong (Hong Kong University of Science and Technology), Dongwei Xiao (The Hong Kong University of Science and Technology), Anthony Cheuk Tung Lai (VX Research Limited), Ping Fan Ke (Singapore Management University), Shuai Wang (Hong Kong University of Science and Technology)
  • Tamias: Feedback-Guided Systematic Concurrency Exploration for Transparent Distributed System Fuzzing
    Congyu Liu, Yaoxu Song, Pedro Fonseca, Yongle Zhang (Purdue University)
  • Validating Rust Compilers with Trait-Type Constraint Graph
    Xin Lai, Ming Wen, Xiaofei Liao, Hai Jin (Huazhong University of Science and Technology)
15:10 – 15:40 Coffee break
15:40 – 17:20
Chair: Jing Liu (Microsoft Research Asia)
  • Efficient GPU Multitasking with Morphable Kernels
    Tingxu Ren, Ruwen Fan, Hao Guo, Minhui Xie, Shiwei Gao, Jiwu Shu, Youyou Lu (Tsinghua University)
  • Ave: Guiding Agentic GPU Optimization Using Data-Flow Invariants
    Haohui Mai (HKUST), Xiaoyan Guo (University of Chinese Academy of Sciences, China), Xiangyun Ding (University of California, Riverside), Daifeng Li (University of Science and Technology of China), Qiuchu Yu, Chenzhun Guo (University of Chinese Academy of Sciences, China), Cong Wang (Tsinghua University), Jiacheng Zhao (University of Chinese Academy of Sciences, China), Christos Kozyrakis (Stanford University), Binhang Yuan (HKUST)
  • Taming Dynamism on GPUs: Cross-SM Kernel Fusion via SM Cooperation and Just-in-Time Reduction
    Jingkai He, Guangda Sun, TianJian Li, Dong Du, Yubin Xia, Haibo Chen (Shanghai Jiao Tong University)
  • M2K: Making the Model-Kernel Interface Explicit for Reliable CUDA Kernel Verification
    Mengting He, Shihao Xia (The Pennsylvania State University), Haomin Jia (SKLP, Institute of Computing Technology, Chinese Academy of Sciences), Wenfei Wu (Peking University), Linhai Song (SKLP, Institute of Computing Technology, Chinese Academy of Sciences)
  • Wavel: A Fast and Efficient Compilation System for Wafer-Scale Accelerators
    Yeqi Huang, Congjie He, Haocheng Xiao, Yanwei Ye, Yi-Chieh Wang, Boyao Song, Yangshen Deng (University of Edinburgh), Ziming Miao, Lingxiao Ma, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh)
  • MeshRT: Compile-Time Governed Wafer-Scale Runtime for Low-Latency High-Throughput Inference
    Congjie He, Le Xu, Zhan Lu, Yeqi Huang, Haocheng Xiao, Cheng Deng (University of Edinburgh), Lingxiao Ma, Ziming Miao, Fan Yang (Microsoft Research), Luo Mai (University of Edinburgh)