Publications

2026

CommBench: Can LLMs Write Correct and Efficient GPU Communication Code?

Shuang Ma, Yuyi Li, Yihan Zhang, Hezhi Xie, Danyang Chen, Shuyang Ji, Ziming Mao, Cheng Ji, Ansha Prashanth, Wenting Yang, Yiran Wang, Chihan Cui, Pei Yu Lin, Ion Stoica, Yang Zhou: CommBench: Can LLMs Write Correct and Efficient GPU Communication Code? CoRR abs/2608.04450 (2026)

CoVA-SFT: A Large-Scale Dataset for Chain of Visual Abstractions.

Tsung-Han Wu, Heekyung Lee, Anya Ji, Haoming Chen, Trevor Darrell, Joseph E. Gonzalez, David M. Chan: CoVA-SFT: A Large-Scale Dataset for Chain of Visual Abstractions. CoRR abs/2608.28958 (2026)

Daydreaming: Stealing Hidden Agent Skills through Black-Box Task Interaction.

Yu-Lin Tsai, Yu-An Lu, Ci-Yang Tsai, Muxi Lyu, Raluca Ada Popa, Chia-Mu Yu: Daydreaming: Stealing Hidden Agent Skills through Black-Box Task Interaction. CoRR abs/2608.26733 (2026)

FreeToken: Efficient Edge-Native MoE Serving with Bandwidth-Adaptive Execution.

Shuo Yang, Xiaoze Fan, Melissa Z. Pan, Haocheng Xi, Zhe Wang, Shanlin Sun, Kurt Keutzer, Song Han, Matei Zaharia, Chenfeng Xu, Ion Stoica: FreeToken: Efficient Edge-Native MoE Serving with Bandwidth-Adaptive Execution. CoRR abs/2608.16157 (2026)

Lakebase: Serverless Postgres over Open Lake Storage.

Jasraj Dange, Andrei Dragus, Ali Ghodsi, Haoyu Huang, Yihe Huang, Stas Kelvich, Heikki Linnakangas, Hans Norheim, Ippokratis Pandis, Nikita Shamgunov, Em Sharnoff, John Spray, Zhou Sun, Reynold Xin, Matei Zaharia: Lakebase: Serverless Postgres over Open Lake Storage. Proc. VLDB Endow. 19(12): 4385-4398 (2026)

Optimality and Trade-offs in Fast BFT SMR (Extended Version).

Neil Giridharan, Minh Tung Nguyen, Ittai Abraham, Allen Clement, Natacha Crooks, Pierre Sutra: Optimality and Trade-offs in Fast BFT SMR (Extended Version). CoRR abs/2608.19629 (2026)

Sintr: Safe Interactive Transactions in the Presence of Byzantine Clients.

Austin T. Li, Daniel H. Lee, Lorenzo Alvisi, Natacha Crooks, Florian Suri-Payer: Sintr: Safe Interactive Transactions in the Presence of Byzantine Clients. CoRR abs/2608.27091 (2026)

The Next Challenge for Agentic Cybersecurity: A Realistic, Contamination-Free Reverse Engineering Benchmark.

Jeremy Spence, Nicholas Assaderaghi, Jinhao Zhu, Nikil Ravi, Raluca Ada Popa, Guannan Wei, Yangruibo Ding, Zhuo Zhang: The Next Challenge for Agentic Cybersecurity: A Realistic, Contamination-Free Reverse Engineering Benchmark. CoRR abs/2608.11469 (2026)

Antiproof: Synthesizing Vulnerability Detectors and Proofs of Exploitability.

Alon Shakevsky, Corban Villa, Ion Stoica, Raluca Ada Popa: Antiproof: Synthesizing Vulnerability Detectors and Proofs of Exploitability. CoRR abs/2607.12316 (2026)

Denial of Deadline: Network-Driven Accuracy Collapse in Distributed Inference Pipelines.

Jhonatan Tavori, Gur-Eyal Sela, Ion Stoica, Gil Zussman: Denial of Deadline: Network-Driven Accuracy Collapse in Distributed Inference Pipelines. CoRR abs/2607.24692 (2026)

Fantastic Adaptive Taxonomies and How to Use Them.

Mert Cemri, Andrei Cojocaru, Melissa Z. Pan, Shu Liu, Shubham Agarwal, Alexander Krentsel, Jay Tang, Kannan Ramchandran, Joseph E. Gonzalez, Matei Zaharia, Alex Dimakis, Ion Stoica: Fantastic Adaptive Taxonomies and How to Use Them. CoRR abs/2607.16387 (2026)

LLM-as-a-Verifier: A General-Purpose Verification Framework.

Jacky Kwok, Shulu Li, Pranav Atreya, Yuejiang Liu, Yixing Jiang, Chelsea Finn, Marco Pavone, Ion Stoica, Azalia Mirhoseini: LLM-as-a-Verifier: A General-Purpose Verification Framework. CoRR abs/2607.05391 (2026)

Prismata: Confining Cross-Site Prompt Injection in Web Agents.

Corban Villa, Alp Eren Ozdarendeli, Sijun Tan, Raluca Ada Popa: Prismata: Confining Cross-Site Prompt Injection in Web Agents. CoRR abs/2607.08147 (2026)

RECEIPT: Deterministic, Reward-Hacking-Resistant Verification for White-Box Agentic XSS Discovery.

Muxi Lyu, Karen Shieh, Yiwei Hou, Hao Wang, Koushik Sen, David A. Wagner: RECEIPT: Deterministic, Reward-Hacking-Resistant Verification for White-Box Agentic XSS Discovery. CoRR abs/2607.18575 (2026)

Recursive Harness Self-Improvement.

Hyunin Lee, Jinglue Xu, Jeffrey Seely, Donghyun Lee, Matei Zaharia, Yujin Tang: Recursive Harness Self-Improvement. CoRR abs/2607.15524 (2026)

ShannonProver: Towards Automating Formal Cryptographic Proofs.

Yiping Ma, Yu-Lin Tsai, Mayank Rathee, Deevashwer Rathee, François Dupressoir, Pierre-Yves Strub, Raluca Ada Popa: ShannonProver: Towards Automating Formal Cryptographic Proofs. CoRR abs/2607.02847 (2026)

Ambulance: saving BFT through racing.

Neil Giridharan, Shubham Mishra, Lorenzo Alvisi, Natacha Crooks, Benjamin Marsh, Hein Meling, Kartik Nayak, Grzegorz Prusak: Ambulance: saving BFT through racing. CoRR abs/2606.25099 (2026)

Arena-T2I Hard: Benchmarking and Improving Faithfulness with Dependency-Aware Checklist.

Yuanhao Ban, Tong Xie, Sohyun An, Yunqi Hong, Evan Frick, I-Hung Hsu, Wei-Lin Chiang, Ion Stoica, Cho-Jui Hsieh: Arena-T2I Hard: Benchmarking and Improving Faithfulness with Dependency-Aware Checklist. CoRR abs/2606.31711 (2026)

BenchEvolver: Frontier Task Synthesis via Solution-Centric Evolution.

Yangzhen Wu, Aaron J. Li, Wenjie Ma, Li Cao, Ziheng Zhou, Mert Cemri, Shu Liu, Yuran Xiu, Chenxiao Yan, Haikun Zhao, Bin Yu, Ion Stoica, Dawn Song: BenchEvolver: Frontier Task Synthesis via Solution-Centric Evolution. CoRR abs/2606.01286 (2026)

Chai: Agentic Discovery of Cryptographic Misuse Vulnerabilities.

Corban Villa, Sohee Kim, Austin Chu, Alon Shakevsky, Raluca Ada Popa: Chai: Agentic Discovery of Cryptographic Misuse Vulnerabilities. CoRR abs/2606.26933 (2026)

Continual Learning Bench: Evaluating Frontier AI Systems in Real-World Stateful Environments.

Parth Asawa, Christopher M. Glaze, Gabriel Orlanski, Ramya Ramakrishnan, Benji Xu, Asim Biswal, Vincent Sunn Chen, Frederic Sala, Matei Zaharia, Joseph E. Gonzalez: Continual Learning Bench: Evaluating Frontier AI Systems in Real-World Stateful Environments. CoRR abs/2606.05661 (2026)

DualEval: Joint Model-Item Calibration for Unified LLM Evaluation.

Aaron J. Li, Hao Huang, Youngmin Park, Yitong Ma, Wei-Lin Chiang, Li Chen, Cho-Jui Hsieh, Bin Yu, Ion Stoica: DualEval: Joint Model-Item Calibration for Unified LLM Evaluation. CoRR abs/2606.26429 (2026)

HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval.

Omin Kwon, Doyeon Kim, Jongseok Park, Seung Yul Lee, Ion Stoica, Jae W. Lee: HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval. CoRR abs/2606.21633 (2026)

Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs.

Yu-An Lu, Ci-Yang Tsai, Yu-Lin Tsai, Raluca Ada Popa, Chia-Mu Yu: Hidden Thoughts Are Not Secret: Reasoning Trace Exposure in LLMs. CoRR abs/2606.00642 (2026)

Idleness is Relative: Exploiting Tool-Call Idle Windows for Offloading in Agentic Systems with MORI.

Tian Xia, Hanchen Li, Zhifei Li, Xiaokun Chen, Hao Kang, Yifan Qiao, Yi Xu, Ion Stoica: Idleness is Relative: Exploiting Tool-Call Idle Windows for Offloading in Agentic Systems with MORI. CoRR abs/2606.00866 (2026)

PIXELRAG: Web Screenshots Beat Text for Retrieval-Augmented Generation.

Yichuan Wang, Zhifei Li, Zirui Wang, Paul Teiletche, Lesheng Jin, Matei Zaharia, Joseph E. Gonzalez, Sewon Min: PIXELRAG: Web Screenshots Beat Text for Retrieval-Augmented Generation. CoRR abs/2606.28344 (2026)

Playful Agentic Robot Learning.

Junyi Zhang, Jiaxin Ge, Hanjun Yoo, Letian Fu, Zihan Yang, Yaowei Liu, Raj Saravanan, Shaofeng Yin, Justin Yu, Dantong Niu, Zirui Wang, Roei Herzig, Ken Goldberg, Yutong Bai, David M. Chan, Ion Stoica, Angjoo Kanazawa, Jiahui Lei, Haiwen Feng, Trevor Darrell: Playful Agentic Robot Learning. CoRR abs/2606.19419 (2026)

Revelio: Cost-Efficient Agentic Memory Safety Vulnerability Detection For Repository-Scale Codebases.

Yiwei Hou, Hao Wang, Muxi Lyu, Marius Momeu, Eric Nguyen, Taige Yang, Koushik Sen, Dawn Song, David A. Wagner: Revelio: Cost-Efficient Agentic Memory Safety Vulnerability Detection For Repository-Scale Codebases. CoRR abs/2606.22263 (2026)

RHO: Your Coding Agent is Secretly a Roboticist.

Karim Elmaaroufi, Justin Svegliato, Sarunas Kalade, Graham Schelle, Sanjit A. Seshia, Matei Zaharia: RHO: Your Coding Agent is Secretly a Roboticist. CoRR abs/2606.16458 (2026)

Stateful Visual Encoders for Vision-Language Models.

Zirui Wang, Junwei Yu, Adam Yala, David M. Chan, Joseph E. Gonzalez, Trevor Darrell: Stateful Visual Encoders for Vision-Language Models. CoRR abs/2606.04433 (2026)

AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs.

Haizhong Zheng, Yizhuo Di, Jiahui Wang, Shuowei Jin, Xueshen Liu, Yongji Wu, Z. Morley Mao, Ion Stoica, Jiawei Zhao, Beidi Chen: AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs. CoRR abs/2605.15565 (2026)

Concurrency without Model Changes: Future-based Asynchronous Function Calling for LLMs.

Guangyu Feng, Huanzhi Mao, Prabal Dutta, Joseph E. Gonzalez: Concurrency without Model Changes: Future-based Asynchronous Function Calling for LLMs. CoRR abs/2605.15077 (2026)

Do Androids Dream of Breaking the Game? Systematically Auditing AI Agent Benchmarks with BenchJack.

Hao Wang, Hanchen Li, Qiuyang Mang, Alvin Cheung, Koushik Sen, Dawn Song: Do Androids Dream of Breaking the Game? Systematically Auditing AI Agent Benchmarks with BenchJack. CoRR abs/2605.12673 (2026)

FrontierSmith: Synthesizing Open-Ended Coding Problems at Scale.

Runyuan He, Qiuyang Mang, Shang Zhou, Kaiyuan Liu, Hanchen Li, Huanzhi Mao, Qizheng Zhang, Zerui Li, Bo Peng, Lufeng Cheng, Tianfu Fu, Yichuan Wang, Wenhao Chai, Jingbo Shang, Alex Dimakis, Joseph E. Gonzalez, Alvin Cheung: FrontierSmith: Synthesizing Open-Ended Coding Problems at Scale. CoRR abs/2605.14445 (2026)

GradShield: Alignment Preserving Finetuning.

Zhanhao Hu, Xiao Huang, Patrick Mendoza, Emad A. Alghamdi, Basel Alomair, Raluca Ada Popa, David A. Wagner: GradShield: Alignment Preserving Finetuning. CoRR abs/2605.14194 (2026)

HarborMaster: Rollback Detection for Trusted Distributed Computing.

Shubham Mishra, Alexander Thomas, Nurzhan Abdrassilov, Kaiyuan Chen, Natacha Crooks, John Kubiatowicz: HarborMaster: Rollback Detection for Trusted Distributed Computing. Proc. VLDB Endow. 19(9): 2126-2139 (2026)

Inductive Deductive Synthesis: Enabling AI to Generate Formally Verified Systems.

Shubham Agarwal, Alexander Krentsel, Shu Liu, Mert Cemri, Audrey Cheng, Rui Meng, Tomas Pfister, Chun-Liang Li, Sylvia Ratnasamy, Aditya G. Parameswaran, Matei Zaharia, Ion Stoica, Mohsen Lesani: Inductive Deductive Synthesis: Enabling AI to Generate Formally Verified Systems. CoRR abs/2605.23109 (2026)

Inference Time Context Sparsity: Illusion or Opportunity?

Sahil Joshi, Prithvi Dixit, Agniva Chowdhury, Anshumali Shrivastava, Joseph E. Gonzalez, Ion Stoica, Kumar Krishna Agrawal, Aditya Desai: Inference Time Context Sparsity: Illusion or Opportunity? CoRR abs/2605.24168 (2026)

Learning, Fast and Slow: Towards LLMs That Adapt Continually.

Rishabh Tiwari, Kusha Sareen, Lakshya A. Agrawal, Joseph E. Gonzalez, Matei Zaharia, Kurt Keutzer, Inderjit S. Dhillon, Rishabh Agarwal, Devvrit Khatri: Learning, Fast and Slow: Towards LLMs That Adapt Continually. CoRR abs/2605.12484 (2026)

Natural Language Query to Configuration for Retrieval Agents.

Melissa Z. Pan, Negar Arabzadeh, Mathew Jacob, Fiodar Kazhamiaka, Esha Choukse, Matei Zaharia: Natural Language Query to Configuration for Retrieval Agents. CoRR abs/2605.27361 (2026)

optimize_anything: A Universal API for Optimizing any Text Parameter.

Lakshya A. Agrawal, Donghyun Lee, Shangyin Tan, Wenjie Ma, Karim Elmaaroufi, Rohit Sandadi, Sanjit A. Seshia, Koushik Sen, Daniel Klein, Ion Stoica, Joseph E. Gonzalez, Omar Khattab, Alexandros G. Dimakis, Matei Zaharia: optimize_anything: A Universal API for Optimizing any Text Parameter. CoRR abs/2605.19633 (2026)

RAG over Thinking Traces Can Improve Reasoning Tasks.

Negar Arabzadeh, Wenjie Ma, Sewon Min, Matei Zaharia: RAG over Thinking Traces Can Improve Reasoning Tasks. CoRR abs/2605.03344 (2026)

Recon: Reconstruction-Guided Reasoning Synthesis for User Modeling.

Alan Zhu, Mihran Miroyan, Carolyn Wang, Andrew Zhou, Lisa Dunlap, Narges Norouzi, Joseph E. Gonzalez: Recon: Reconstruction-Guided Reasoning Synthesis for User Modeling. CoRR abs/2605.26969 (2026)

The Golden Rule of Big Memory: Persistence Is Not Harmful.

Yu Hua, Xue (Steve) Liu, Ion Stoica: The Golden Rule of Big Memory: Persistence Is Not Harmful. Commun. ACM 69(5): 51-55 (2026)

The Time is Here for Just-in-Time Systems: Challenges and Opportunities.

Shu Liu, Alexander Krentsel, Shubham Agarwal, Mert Cemri, Ziming Mao, Soujanya Ponnapalli, Alexandros G. Dimakis, Sylvia Ratnasamy, Matei Zaharia, Aditya G. Parameswaran, Ion Stoica: The Time is Here for Just-in-Time Systems: Challenges and Opportunities. CoRR abs/2605.24096 (2026)

Uncovering Intra-expert Activation Sparsity for Efficient Mixture-of-Expert Model Execution.

Jongseok Park, Sunga Kim, Zhenyu Gu, Ion Stoica, Alvin Cheung: Uncovering Intra-expert Activation Sparsity for Efficient Mixture-of-Expert Model Execution. CoRR abs/2605.08575 (2026)

Unleashing Scalable Context Parallelism for Foundation Models Pre-Training via FCP.

Yilong Zhao, Xiaonan Nie, Kan Zhu, Shuang Ma, Zhichao Lai, Hongxiang Hao, Yang Zhou, Baris Kasikci, Ion Stoica: Unleashing Scalable Context Parallelism for Foundation Models Pre-Training via FCP. CoRR abs/2605.08524 (2026)

Web Agents Should Adopt the Plan-Then-Execute Paradigm.

Julien Piet, Annabella Chow, Yiwei Hou, Muxi Lyu, Sylvie Venuto, Jinhao Zhu, Raluca Ada Popa, David A. Wagner: Web Agents Should Adopt the Plan-Then-Execute Paradigm. CoRR abs/2605.14290 (2026)

AI-Driven Research for Databases.

Audrey Cheng, Harald Ng, Aaron N. Kabcenell, Peter Bailis, Matei Zaharia, Lin Ma, Xiao Shi, Ion Stoica: AI-Driven Research for Databases. CoRR abs/2604.06566 (2026)

Can QPP Choose the Right Query Variant? Evaluating Query Variant Selection for RAG Pipelines.

Negar Arabzadeh, Andrew Drozdov, Michael Bendersky, Matei Zaharia: Can QPP Choose the Right Query Variant? Evaluating Query Variant Selection for RAG Pipelines. CoRR abs/2604.22661 (2026)

ClawEnvKit: Automatic Environment Generation for Claw-Like Agents.

Xirui Li, Ming Li, Ion Stoica, Cho-Jui Hsieh, Tianyi Zhou: ClawEnvKit: Automatic Environment Generation for Claw-Like Agents. CoRR abs/2604.18543 (2026)

Combee: Scaling Prompt Learning for Self-Improving Language Model Agents.

Hanchen Li, Runyuan He, Qizheng Zhang, Changxiu Ji, Qiuyang Mang, Xiaokun Chen, Lakshya A. Agrawal, Wei-Liang Liao, Eric Yang, Alvin Cheung, James Zou, Kunle Olukotun, Ion Stoica, Joseph E. Gonzalez: Combee: Scaling Prompt Learning for Self-Improving Language Model Agents. CoRR abs/2604.04247 (2026)

Cooperate to Compete: Strategic Coordination in Multi-Agent Conquest.

Abigail O'Neill, Alan Zhu, Mihran Miroyan, Narges Norouzi, Joseph E. Gonzalez: Cooperate to Compete: Strategic Coordination in Multi-Agent Conquest. CoRR abs/2604.25088 (2026)

Foundry: Template-Based CUDA Graph Context Materialization for Fast LLM Serving Cold Start.

Xueshen Liu, Yongji Wu, Yuncheng Yao, Danyang Zhuo, Ion Stoica, Z. Morley Mao: Foundry: Template-Based CUDA Graph Context Materialization for Fast LLM Serving Cold Start. CoRR abs/2604.06664 (2026)

KISS Sorcar: A Stupidly-Simple General-Purpose and Software Engineering AI Assistant.

Koushik Sen: KISS Sorcar: A Stupidly-Simple General-Purpose and Software Engineering AI Assistant. CoRR abs/2604.23822 (2026)

Onyx: Cost-Efficient Disk-Oblivious ANN Search.

Deevashwer Rathee, Jean-Luc Watson, Zirui Neil Zhao, G. Edward Suh, Raluca Ada Popa: Onyx: Cost-Efficient Disk-Oblivious ANN Search. CoRR abs/2604.20401 (2026)

Opal: Private Memory for Personal AI.

Darya Kaviani, Alp Eren Ozdarendeli, Jinhao Zhu, Yu Ding, Raluca Ada Popa: Opal: Private Memory for Personal AI. CoRR abs/2604.02522 (2026)

SIEVE: Sample-Efficient Parametric Learning from Natural Language.

Parth Asawa, Alexandros G. Dimakis, Matei Zaharia: SIEVE: Sample-Efficient Parametric Learning from Natural Language. CoRR abs/2604.02339 (2026)

Train Separately, Merge Together: Modular Post-Training with Mixture-of-Experts.

Jacob Morrison, Sanjay Adhikesaven, Akshita Bhagia, Matei Zaharia, Noah A. Smith, Sewon Min: Train Separately, Merge Together: Modular Post-Training with Mixture-of-Experts. CoRR abs/2604.18473 (2026)

UCCL-Zip: Lossless Compression Supercharged GPU Communication.

Shuang Ma, ChonLam Lao, Zhiying Xu, Zhuang Wang, Ziming Mao, Delong Meng, Jia Zhen, Jun Wu, Ion Stoica, Yida Wang, Yang Zhou: UCCL-Zip: Lossless Compression Supercharged GPU Communication. CoRR abs/2604.17172 (2026)

Title: An AI Stack: From Scaling AI Workloads to Evaluating LLMs.

Ion Stoica: Title: An AI Stack: From Scaling AI Workloads to Evaluating LLMs. ASPLOS (2) 2026: 3-4

Flash-KMeans: Fast and Memory-Efficient Exact K-Means.

Shuo Yang, Haocheng Xi, Yilong Zhao, Muyang Li, Xiaoze Fan, Jintao Zhang, Han Cai, Yujun Lin, Xiuyu Li, Kurt Keutzer, Song Han, Chenfeng Xu, Ion Stoica: Flash-KMeans: Fast and Memory-Efficient Exact K-Means. CoRR abs/2603.09229 (2026)

M2RNN: Non-Linear RNNs with Matrix-Valued States for Scalable Language Modeling.

Mayank Mishra, Shawn Tan, Ion Stoica, Joseph Gonzalez, Tri Dao: M2RNN: Non-Linear RNNs with Matrix-Valued States for Scalable Language Modeling. CoRR abs/2603.14360 (2026)

OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning.

Krista Opsahl-Ong, Arnav Singhvi, Jasmine Collins, Ivan Zhou, Cindy Wang, Ashutosh Baheti, Owen Oertell, Jacob Portes, Sam Havens, Erich Elsen, Michael Bendersky, Matei Zaharia, Xing Chen: OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning. CoRR abs/2603.08655 (2026)

SageBwd: A Trainable Low-bit Attention.

Jintao Zhang, Marco Chen, Haoxu Wang, Kai Jiang, Ion Stoica, Joseph E. Gonzalez, Jianfei Chen, Jun Zhu: SageBwd: A Trainable Low-bit Attention. CoRR abs/2603.02170 (2026)

SVG-EAR: Parameter-Free Linear Compensation for Sparse Video Generation via Error-aware Routing.

Xuanyi Zhou, Qiuyang Mang, Shuo Yang, Haocheng Xi, Jintao Zhang, Huanzhi Mao, Joseph E. Gonzalez, Kurt Keutzer, Ion Stoica, Alvin Cheung: SVG-EAR: Parameter-Free Linear Compensation for Sparse Video Generation via Error-aware Routing. CoRR abs/2603.08982 (2026)

The Price Reversal Phenomenon: When Cheaper Reasoning Models End Up Costing More.

Lingjiao Chen, Chi Zhang, Yeye He, Ion Stoica, Matei Zaharia, James Zou: The Price Reversal Phenomenon: When Cheaper Reasoning Models End Up Costing More. CoRR abs/2603.23971 (2026)

Qrita: High-performance Top-k and Top-p Algorithm for GPUs using Pivot-based Truncation and Selection.

Jongseok Park, Sunga Kim, Alvin Cheung, Ion Stoica: Qrita: High-performance Top-k and Top-p Algorithm for GPUs using Pivot-based Truncation and Selection. CoRR abs/2602.01518 (2026)

AdaEvolve: Adaptive LLM Driven Zeroth-Order Optimization.

Mert Cemri, Shubham Agrawal, Akshat Gupta, Shu Liu, Audrey Cheng, Qiuyang Mang, Ashwin Naren, Lutfi Eren Erdogan, Koushik Sen, Matei Zaharia, Alex Dimakis, Ion Stoica: AdaEvolve: Adaptive LLM Driven Zeroth-Order Optimization. CoRR abs/2602.20133 (2026)

Arming Data Agents with Tribal Knowledge.

Shubham Agarwal, Asim Biswal, Sepanta Zeighami, Alvin Cheung, Joseph Gonzalez, Aditya G. Parameswaran: Arming Data Agents with Tribal Knowledge. CoRR abs/2602.13521 (2026)

DS SERVE: A Framework for Efficient and Scalable Neural Retrieval.

Jinjian Liu, Yichuan Wang, Xinxi Lyu, Rulin Shao, Joseph E. Gonzalez, Matei Zaharia, Sewon Min: DS SERVE: A Framework for Efficient and Scalable Neural Retrieval. CoRR abs/2602.22224 (2026)

EvoX: Meta-Evolution for Automated Discovery.

Shu Liu, Shubham Agarwal, Monishwaran Maheswaran, Mert Cemri, Zhifei Li, Qiuyang Mang, Ashwin Naren, Ethan Boneh, Audrey Cheng, Melissa Z. Pan, Alexander Du, Kurt Keutzer, Alexandros G. Dimakis, Koushik Sen, Matei Zaharia, Ion Stoica: EvoX: Meta-Evolution for Automated Discovery. CoRR abs/2602.23413 (2026)

It's not a lie if you don't get caught: simplifying reconfiguration in SMR through dirty logs.

Allen Clement, Natacha Crooks, Neil Giridharan, Alex Shamis: It's not a lie if you don't get caught: simplifying reconfiguration in SMR through dirty logs. CoRR abs/2602.09441 (2026)

K-Search: LLM Kernel Generation via Co-Evolving Intrinsic World Model.

Shiyi Cao, Ziming Mao, Joseph E. Gonzalez, Ion Stoica: K-Search: LLM Kernel Generation via Co-Evolving Intrinsic World Model. CoRR abs/2602.19128 (2026)

Proteus: Append-Only Ledgers for (Mostly) Trusted Execution Environments.

Shubham Mishra, João Gonçalves, Chawinphat Tankuranand, Neil Giridharan, Natacha Crooks, Heidi Howard, Chris Jensen: Proteus: Append-Only Ledgers for (Mostly) Trusted Execution Environments. CoRR abs/2602.05346 (2026)

Real Life Is Uncertain. Consensus Should Be Too!

Reginald Frank, Soujanya Ponnapalli, Octavio Lomeli, Neil Giridharan, Marcos K. Aguilera, Natacha Crooks: Real Life Is Uncertain. Consensus Should Be Too! CoRR abs/2602.11362 (2026)

SLA2: Sparse-Linear Attention with Learnable Routing and QAT.

Jintao Zhang, Haoxu Wang, Kai Jiang, Kaiwen Zheng, Youhe Jiang, Ion Stoica, Jianfei Chen, Jun Zhu, Joseph E. Gonzalez: SLA2: Sparse-Linear Attention with Learnable Routing and QAT. CoRR abs/2602.12675 (2026)

Agentix: An Efficient Serving Engine for LLM Agents as General Programs.

Michael Luo, Xiaoxiang Shi, Colin Cai, Tianjun Zhang, Justin Wong, Yichuan Wang, Chi Wang, Yanping Huang, Zhifeng Chen, Joseph E. Gonzalez, Ion Stoica: Agentix: An Efficient Serving Engine for LLM Agents as General Programs. NSDI 2026: 2443-2459

Auditing Black-Box LLM APIs with a Rank-Based Uniformity Test.

Xiaoyuan Zhu, Yaowen Ye, Tianyi Qiu, Hanlin Zhu, Sijun Tan, Ajraf Mannan, Jonathan Michala, Raluca A. Popa, Willie Neiswanger: Auditing Black-Box LLM APIs with a Rank-Based Uniformity Test. ICLR 2026

Automatically Learning Skills for Coding Agents.

Shangyin Tan, Lakshya A. Agrawal, Rohit Sandadi, Dan Klein, Koushik Sen, Alexandros G. Dimakis, Matei Zaharia: Automatically Learning Skills for Coding Agents. CAIS 2026: 1310-1315

Can QPP Choose the Right Query variant? Evaluating Query Variant Selection for RAG Pipelines.

Negar Arabzadeh, Andrew Drozdov, Michael Bendersky, Matei Zaharia: Can QPP Choose the Right Query variant? Evaluating Query Variant Selection for RAG Pipelines. SIGIR 2026: 2813-2823

CHORUS: Secret Recovery with Ephemeral Client Committees.

Deevashwer Rathee, Emma Dauterman, Allison Li, Raluca Ada Popa: CHORUS: Secret Recovery with Ephemeral Client Committees. SP 2026: 2307-2326

Chorus: Secret Recovery with Ephemeral Client Committees.

Deevashwer Rathee, Emma Dauterman, Allison Li, Raluca Ada Popa: Chorus: Secret Recovery with Ephemeral Client Committees. IACR Cryptol. ePrint Arch. 2026: 715 (2026)

Composing Policy Gradients and Prompt Optimization for Language Model Programs.

Noah Ziems, Dilara Soylu, Lakshya A. Agrawal, Isaac Miller, Liheng Lai, Chen Qian, Kaiqiang Song, Meng Jiang, Dan Klein, Matei Zaharia, Karel D'Oosterlinck, Christopher Potts, Omar Khattab: Composing Policy Gradients and Prompt Optimization for Language Model Programs. CAIS 2026: 197-213

Computer Agent Arena: Toward Human-Centric Evaluation and Analysis of Computer-Use Agents.

Bowen Wang, Xinyuan Wang, Jiaqi Deng, Tianbao Xie, Ryan Li, Yanzhe Zhang, Junli Wang, Dunjie Lu, Zicheng Gong, Gavin Li, Toh Jing Hua, Wei-Lin Chiang, Ion Stoica, Diyi Yang, Yu Su, Yi Zhang, Zhiguo Wang, Victor Zhong, Tao Yu: Computer Agent Arena: Toward Human-Centric Evaluation and Analysis of Computer-Use Agents. ICLR 2026

DeltaQuant: 4-bit Video Diffusion Models with Spatiotemporal Delta Smoothing.

Xingyang Li, Samuel Tesfai, Zhekai Zhang, Haocheng Xi, Shuo Yang, Lvmin Zhang, Yufei Sun, Kelly Peng, Maneesh Agrawala, Ion Stoica, Kurt Keutzer, Jun-Yan Zhu, Song Han, Yujun Lin, Muyang Li: DeltaQuant: 4-bit Video Diffusion Models with Spatiotemporal Delta Smoothing. CVPR 2026: 43578-43588

DS SERVE: A Framework for Efficient and Scalable Neural Retrieval.

Jinjian Liu, Yichuan Wang, Xinxi Lyu, Rulin Shao, Joseph E. Gonzalez, Matei Zaharia, Sewon Min: DS SERVE: A Framework for Efficient and Scalable Neural Retrieval. AAAI 2026: 41631-41633

Efficient ML Model Updates for Deeply Embedded Microcontrollers.

Shishir G. Patil, Sam Kumar, Prabal Dutta, Joseph E. Gonzalez: Efficient ML Model Updates for Deeply Embedded Microcontrollers. EuroSys 2026: 1550-1564

GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning.

Lakshya A. Agrawal, Shangyin Tan, Dilara Soylu, Noah Ziems, Rishi Khare, Krista Opsahl-Ong, Arnav Singhvi, Herumb Shandilya, Michael J. Ryan, Meng Jiang, Christopher Potts, Koushik Sen, Alex Dimakis, Ion Stoica, Dan Klein, Matei Zaharia, Omar Khattab: GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning. ICLR 2026

Model AI Assignments 2026.

Todd W. Neller, Steve Geinitz, Kevin Wang, Zach Dodds, Nicholas Dodds, Ryan O'Connor, Aimen Taha, Ananta Manoranjan, Saurabh Ray, Deepak Ajwani, Fang Sun, Paul Zhang, Pranav Subbaraman, Yizhou Sun, Lisa Dunlap, Taehan Kim, Deena Sun, Ishir Garg, Mark Ogata, Aakarsh Vermani, Narges Norouzi, Joseph Gonzalez, Varada Kolhatkar: Model AI Assignments 2026. AAAI 2026: 40944-40946

optimize_anything: A Universal API for Optimizing any Text Parameter.

Lakshya A. Agrawal, Donghyun Lee, Shangyin Tan, Wenjie Ma, Karim Elmaaroufi, Sanjit A. Seshia, Koushik Sen, Dan Klein, Ion Stoica, Joseph E. Gonzalez, Omar Khattab, Alexandros G. Dimakis, Matei Zaharia: optimize_anything: A Universal API for Optimizing any Text Parameter. CAIS 2026: 1300-1304

optimize_anything: Unified Text Optimization can Outperform Specialized Systems.

Lakshya A. Agrawal, Donghyun Lee, Shangyin Tan, Wenjie Ma, Karim Elmaaroufi, Rohit Sandadi, Sanjit A. Seshia, Koushik Sen, Dan Klein, Ion Stoica, Joseph E. Gonzalez, Omar Khattab, Alexandros G. Dimakis, Matei Zaharia: optimize_anything: Unified Text Optimization can Outperform Specialized Systems. CAIS 2026: 1-16

Parallel Environments for Agents.

Shangyin Tan, Jialin Zhang, Matei Zaharia: Parallel Environments for Agents. CAIS 2026: 1128-1134

RIOT: Replicated Independently-Ordered Transactions.

Jim Webber, Georgios Theodorakis, Hugo Firth, Natacha Crooks: RIOT: Replicated Independently-Ordered Transactions. SIGMOD Companion 2026: 464-476

RLBoost: Harvesting Preemptible Cloud Resources for Cost-Efficient Reinforcement Learning on LLMs.

Yongji Wu, Xueshen Liu, Haizhong Zheng, Juncheng Gu, Beidi Chen, Z. Morley Mao, Arvind Krishnamurthy, Ion Stoica: RLBoost: Harvesting Preemptible Cloud Resources for Cost-Efficient Reinforcement Learning on LLMs. NSDI 2026: 1323-1339

Search Arena: Analyzing Search-Augmented LLMs.

Mihran Miroyan, Tsung-Han Wu, Logan King, Tianle Li, Jiayi Pan, Xinyan Hu, Wei-Lin Chiang, Anastasios Angelopoulos, Trevor Darrell, Narges Norouzi, Joseph E. Gonzalez: Search Arena: Analyzing Search-Augmented LLMs. ICLR 2026

SkyDiscover: A Flexible, Adaptive Framework for AI-Driven Scientific and Algorithmic Discovery.

Shu Liu, Mert Cemri, Shubham Agarwal, Alexander Krentsel, Ashwin Naren, Qiuyang Mang, Zhifei Li, Akshat Gupta, Monishwaran Maheswaran, Audrey Cheng, Melissa Z. Pan, Ethan Boneh, Kannan Ramchandran, Koushik Sen, Matei Zaharia, Alexandros G. Dimakis, Ion Stoica: SkyDiscover: A Flexible, Adaptive Framework for AI-Driven Scientific and Algorithmic Discovery. CAIS 2026: 1223-1227

SkyWalker: A Locality-Aware Cross-Region Load Balancer for LLM Inference.

Tian Xia, Ziming Mao, Jamison Kerney, Ethan J. Jackson, Zhifei Li, Jiarong Xing, Scott Shenker, Ion Stoica: SkyWalker: A Locality-Aware Cross-Region Load Balancer for LLM Inference. EuroSys 2026: 1349-1364

SonicMoE: Accelerating MoE with IO and Tile-aware Optimizations.

Wentao Guo, Mayank Mishra, Xinle Cheng, Ion Stoica, Tri Dao: SonicMoE: Accelerating MoE with IO and Tile-aware Optimizations. ICLR 2026

SVG-EAR: Parameter-Free Linear Compensation for Sparse Video Generation via Error-aware Routing.

Xuanyi Zhou, Qiuyang Mang, Shuo Yang, Haocheng Xi, Jintao Zhang, Huanzhi Mao, Joseph E. Gonzalez, Kurt Keutzer, Ion Stoica, Alvin Cheung: SVG-EAR: Parameter-Free Linear Compensation for Sparse Video Generation via Error-aware Routing. ECCV (50) 2026: 167-185

Towards AI-Native Data Systems with the Semantic Operator Model and LOTUS.

Liana Patel, Carlos Guestrin, Matei Zaharia: Towards AI-Native Data Systems with the Semantic Operator Model and LOTUS. IEEE Data Eng. Bull. 50(1): 59-73 (2026)

TURBO: Utility-Aware Bandwidth Allocation for Cloud-Augmented Autonomous Control.

Peter Schafhalter, Alexander Krentsel, Hongbo Wei, Joseph E. Gonzalez, Sylvia Ratnasamy, Scott Shenker, Ion Stoica: TURBO: Utility-Aware Bandwidth Allocation for Cloud-Augmented Autonomous Control. NINeS 2026: 18:1-18:34

vAttention: Verified Sparse Attention via Sampling.

Aditya Desai, Kumar Krishna Agrawal, Shuo Yang, Alejandro Cuadron, Luis Gaspar Schroeder, Matei Zaharia, Joseph E. Gonzalez, Ion Stoica: vAttention: Verified Sparse Attention via Sampling. ICLR 2026

Verifiable PIR with Small Client Storage.

Mayank Rathee, Keewoo Lee, Raluca Ada Popa: Verifiable PIR with Small Client Storage. SP 2026: 1423-1442

Bringing the Operational and Analytical Worlds Together with Lakebase.

Matei Zaharia: Bringing the Operational and Analytical Worlds Together with Lakebase. Proc. VLDB Endow. 18(12): 5539 (2025)

SCGAgent: Recreating the Benefits of Reasoning Models for Secure Code Generation with Agentic Workflows.

Rebecca Saul, Hao Wang, Koushik Sen, David A. Wagner: SCGAgent: Recreating the Benefits of Reasoning Models for Secure Code Generation with Agentic Workflows. CoRR abs/2506.07313 (2025)

Reproducibility Reports of the 2024 International Conference on Management of Data, SIGMOD ARI Reports 2024, Santiago, Chile, June 9-15, 2024.

Manos Athanassoulis, Natacha Crooks, Holger Pirk: Reproducibility Reports of the 2024 International Conference on Management of Data, SIGMOD ARI Reports 2024, Santiago, Chile, June 9-15, 2024. ACM 2025, ISBN 979-8-4007-1179-4 [contents]

World Model on Million-Length Video And Language With Blockwise RingAttention.

Hao Liu, Wilson Yan, Matei Zaharia, Pieter Abbeel: World Model on Million-Length Video And Language With Blockwise RingAttention. CoRR abs/2402.08268 (2024)

Starburst: A Cost-aware Scheduler for Hybrid Cloud

Michael Luo, Siyuan Zhuang, Suryaprakash Vengadesan, and Romil Bhardwaj, UC Berkeley; Justin Chang, UC Santa Barbara; Eric Friedman, Scott Shenker, and Ion Stoica, UC Berkeley

Dynamic Inference of Likely Symbolic Tensor Shapes in Python Machine Learning Programs.

Dan Zheng, Koushik Sen: Dynamic Inference of Likely Symbolic Tensor Shapes in Python Machine Learning Programs. ICSE-SEIP 2024: 147-156

Confidential Computing or Cryptographic Computing?: Tradeoffs between cryptography and hardware enclaves.

Raluca Ada Popa: Confidential Computing or Cryptographic Computing?: Tradeoffs between cryptography and hardware enclaves. ACM Queue 22(2) (2024)

ACORN: Performant and Predicate-Agnostic Search Over Vector Embeddings and Structured Data.

Liana Patel, Peter Kraft, Carlos Guestrin, Matei Zaharia: ACORN: Performant and Predicate-Agnostic Search Over Vector Embeddings and Structured Data. CoRR abs/2403.04871 (2024)

Break the Sequential Dependency of LLM Inference Using Lookahead Decoding.

Yichao Fu, Peter Bailis, Ion Stoica, Hao Zhang: Break the Sequential Dependency of LLM Inference Using Lookahead Decoding. CoRR abs/2402.02057 (2024)

LLM4Fuzz: Guided Fuzzing of Smart Contracts with Large Language Models.

Chaofan Shou, Jing Liu, Doudou Lu, Koushik Sen: LLM4Fuzz: Guided Fuzzing of Smart Contracts with Large Language Models. CoRR abs/2401.11108 (2024)

The Story of GraphLab - From Scaling Machine Learning to Shaping Graph Systems Research.

Joseph E. Gonzalez, Yucheng Low: The Story of GraphLab - From Scaling Machine Learning to Shaping Graph Systems Research. Proc. VLDB Endow. 16(12): 4138 (2023)

Efficient Data Sharing across Trust Domains.

Natacha Crooks: Efficient Data Sharing across Trust Domains. SIGMOD Rec. 52(2): 36-37 (2023)

ItyFuzz: Snapshot-Based Fuzzer for Smart Contract.

Chaofan Shou, Shangyin Tan, Koushik Sen: ItyFuzz: Snapshot-Based Fuzzer for Smart Contract. ISSTA 2023: 322-333

Proceedings of the 19th Workshop on Hot Topics in Operating Systems, HOTOS 2023, Providence, RI, USA, June 22-24, 2023.

Malte Schwarzkopf, Andrew Baumann, Natacha Crooks: Proceedings of the 19th Workshop on Hot Topics in Operating Systems, HOTOS 2023, Providence, RI, USA, June 22-24, 2023. ACM 2023 [contents]

ELSA: Secure Aggregation for Federated Learning with Malicious Actors.

Mayank Rathee, Conghao Shen, Sameer Wagh, Raluca Ada Popa: ELSA: Secure Aggregation for Federated Learning with Malicious Actors. SP 2023: 1961-1979

MPCAuth: Multi-factor Authentication for Distributed-trust Systems.

Sijun Tan, Weikeng Chen, Ryan Deng, Raluca Ada Popa: MPCAuth: Multi-factor Authentication for Distributed-trust Systems. SP 2023: 829-847

2022

Using Language to Extend to Unseen Domains.

Lisa Dunlap, Clara Mohri, Devin Guillory, Han Zhang, Trevor Darrell, Joseph E. Gonzalez, Aditi Raghunathan, Anna Rohrbach: Using Language to Extend to Unseen Domains. CoRR abs/2210.09520 (2022)

The Wisdom of Hindsight Makes Language Models Better Instruction Followers.

Tianjun Zhang, Fangchen Liu, Justin Wong, Pieter Abbeel, Joseph E. Gonzalez: The Wisdom of Hindsight Makes Language Models Better Instruction Followers. CoRR abs/2302.05206 (2023)

Exoshuffle-CloudSort.

Frank Sifei Luan, Stephanie Wang, Samyukta Yagati, Sean Kim, Kenneth Lien, Isaac Ong, Tony Hong, SangBin Cho, Eric Liang, Ion Stoica: Exoshuffle-CloudSort. CoRR abs/2301.03734 (2023)

2022

Kernel-as-a-Service: A Serverless Interface to GPUs.

Nathan Pemberton, Anton Zabreyko, Zhoujie Ding, Randy H. Katz, Joseph Gonzalez: Kernel-as-a-Service: A Serverless Interface to GPUs. CoRR abs/2212.08146 (2022)

ELSA: Secure Aggregation for Federated Learning with Malicious Actors.

Mayank Rathee, Conghao Shen, Sameer Wagh, Raluca Ada Popa: ELSA: Secure Aggregation for Federated Learning with Malicious Actors. IACR Cryptol. ePrint Arch. 2022: 1695 (2022)

Benchmarking Language Models for Code Syntax Understanding.

Da Shen, Xinyun Chen, Chenguang Wang, Koushik Sen, Dawn Song: Benchmarking Language Models for Code Syntax Understanding. EMNLP (Findings) 2022: 3071-3093

Keep CALM and CRDT On.

Shadaj Laddad, Conor Power, Mae Milano, Alvin Cheung, Natacha Crooks, Joseph M. Hellerstein: Keep CALM and CRDT On. Proc. VLDB Endow. 16(4): 856-863 (2022)

PALT: Parameter-Lite Transfer of Language Models for Knowledge Graph Completion.

Jianhao Shen, Chenguang Wang, Ye Yuan, Jiawei Han, Heng Ji, Koushik Sen, Ming Zhang, Dawn Song: PALT: Parameter-Lite Transfer of Language Models for Knowledge Graph Completion. EMNLP (Findings) 2022: 3833-3847

Global perspectives of diversity, equity, and inclusion.

Luiz André Barroso, Tanzeem Choudhury, Manish Gupta, Oyekunle A. Olukotun, Raluca Ada Popa, Dawn Xiaodong Song, David A. Patterson: Global perspectives of diversity, equity, and inclusion. Commun. ACM 65(12): 30-31 (2022)

Multitask Vision-Language Prompt Tuning.

Sheng Shen, Shijia Yang, Tianjun Zhang, Bohan Zhai, Joseph E. Gonzalez, Kurt Keutzer, Trevor Darrell: Multitask Vision-Language Prompt Tuning. CoRR abs/2211.11720 (2022)

TEMPERA: Test-Time Prompting via Reinforcement Learning.

Tianjun Zhang, Xuezhi Wang, Denny Zhou, Dale Schuurmans, Joseph E. Gonzalez: TEMPERA: Test-Time Prompting via Reinforcement Learning. CoRR abs/2211.11890 (2022)

Reflections on trusting distributed trust.

Emma Dauterman, Vivian Fang, Natacha Crooks, Raluca Ada Popa: Reflections on trusting distributed trust. HotNets 2022: 38-45

The internet of things in a laptop: rapid prototyping for IoT applications with digibox.

Silvery Fu, Hong Zhang, Sylvia Ratnasamy, Ion Stoica: The internet of things in a laptop: rapid prototyping for IoT applications with digibox. HotNets 2022: 24-30

On Optimizing the Communication of Model Parallelism.

Yonghao Zhuang, Hexu Zhao, Lianmin Zheng, Zhuohan Li, Eric P. Xing, Qirong Ho, Joseph E. Gonzalez, Ion Stoica, Hao Zhang: On Optimizing the Communication of Model Parallelism. CoRR abs/2211.05322 (2022)

ZK-IMG: Attested Images via Zero-Knowledge Proofs to Fight Disinformation.

Daniel Kang, Tatsunori Hashimoto, Ion Stoica, Yi Sun: ZK-IMG: Attested Images via Zero-Knowledge Proofs to Fight Disinformation. CoRR abs/2211.04775 (2022)

Reliable Visual Question Answering: Abstain Rather Than Answer Incorrectly.

Spencer Whitehead, Suzanne Petryk, Vedaad Shakib, Joseph Gonzalez, Trevor Darrell, Anna Rohrbach, Marcus Rohrbach: Reliable Visual Question Answering: Abstain Rather Than Answer Incorrectly. ECCV (36) 2022: 148-166

LGV: Boosting Adversarial Example Transferability from Large Geometric Vicinity.

Martin Gubri, Maxime Cordy, Mike Papadakis, Yves Le Traon, Koushik Sen: LGV: Boosting Adversarial Example Transferability from Large Geometric Vicinity. ECCV (4) 2022: 603-618

All You Need is LUV: Unsupervised Collection of Labeled Images Using UV-Fluorescent Markings.

Brijen Thananjeyan, Justin Kerr, Huang Huang, Joseph E. Gonzalez, Ken Goldberg: All You Need is LUV: Unsupervised Collection of Labeled Images Using UV-Fluorescent Markings. IROS 2022: 3241-3248

Benchmarking Language Models for Code Syntax Understanding.

Da Shen, Xinyun Chen, Chenguang Wang, Koushik Sen, Dawn Song: Benchmarking Language Models for Code Syntax Understanding. CoRR abs/2210.14473 (2022)

PALT: Parameter-Lite Transfer of Language Models for Knowledge Graph Completion.

Jianhao Shen, Chenguang Wang, Ye Yuan, Jiawei Han, Heng Ji, Koushik Sen, Ming Zhang, Dawn Song: PALT: Parameter-Lite Transfer of Language Models for Knowledge Graph Completion. CoRR abs/2210.13715 (2022)

Context-Aware Streaming Perception in Dynamic Environments.

Gur-Eyal Sela, Ionel Gog, Justin Wong, Kumar Krishna Agrawal, Xiangxi Mo, Sukrit Kalra, Peter Schafhalter, Eric Leong, Xin Wang, Bharathan Balaji, Joseph Gonzalez, Ion Stoica: Context-Aware Streaming Perception in Dynamic Environments. ECCV (38) 2022: 621-638

Keep CALM and CRDT On.

Shadaj Laddad, Conor Power, Mae Milano, Alvin Cheung, Natacha Crooks, Joseph M. Hellerstein: Keep CALM and CRDT On. CoRR abs/2210.12605 (2022)

Reliable Visual Question Answering: Abstain Rather Than Answer Incorrectly.

Spencer Whitehead, Suzanne Petryk, Vedaad Shakib, Joseph Gonzalez, Trevor Darrell, Anna Rohrbach, Marcus Rohrbach: Reliable Visual Question Answering: Abstain Rather Than Answer Incorrectly. CoRR abs/2204.13631 (2022)

CLUTR: Curriculum Learning via Unsupervised Task Representation Learning.

Abdus Salam Azad, Izzeddin Gur, Aleksandra Faust, Pieter Abbeel, Ion Stoica: CLUTR: Curriculum Learning via Unsupervised Task Representation Learning. CoRR abs/2210.10243 (2022)

Brief Announcement: It's not easy to relax: liveness in chained BFT protocols.

Ittai Abraham, Natacha Crooks, Neil Giridharan, Heidi Howard, Florian Suri-Payer: Brief Announcement: It's not easy to relax: liveness in chained BFT protocols. DISC 2022: 39:1-39:3

Scaling up Trustless DNN Inference with Zero-Knowledge Proofs.

Daniel Kang, Tatsunori Hashimoto, Ion Stoica, Yi Sun: Scaling up Trustless DNN Inference with Zero-Knowledge Proofs. CoRR abs/2210.08674 (2022)

Reflections on trusting distributed trust.

Emma Dauterman, Vivian Fang, Natacha Crooks, Raluca Ada Popa: Reflections on trusting distributed trust. CoRR abs/2210.08127 (2022)

Skyplane: Optimizing Transfer Cost and Throughput Using Cloud-Aware Overlays.

Paras Jain, Sam Kumar, Sarah Wooders, Shishir G. Patil, Joseph E. Gonzalez, Ion Stoica: Skyplane: Optimizing Transfer Cost and Throughput Using Cloud-Aware Overlays. CoRR abs/2210.07259 (2022)

Prior Knowledge-Guided Attention in Self-Supervised Vision Transformers.

Kevin Miao, Akash Gokul, Raghav Singh, Suzanne Petryk, Joseph Gonzalez, Kurt Keutzer, Trevor Darrell, Colorado Reed: Prior Knowledge-Guided Attention in Self-Supervised Vision Transformers. CoRR abs/2209.03745 (2022)

Spectral Decomposition Representation for Reinforcement Learning.

Tongzheng Ren, Tianjun Zhang, Lisa Lee, Joseph E. Gonzalez, Dale Schuurmans, Bo Dai: Spectral Decomposition Representation for Reinforcement Learning. CoRR abs/2208.09515 (2022)

Context-Aware Streaming Perception in Dynamic Environments.

Gur-Eyal Sela, Ionel Gog, Justin Wong, Kumar Krishna Agrawal, Xiangxi Mo, Sukrit Kalra, Peter Schafhalter, Eric Leong, Xin Wang, Bharathan Balaji, Joseph Gonzalez, Ion Stoica: Context-Aware Streaming Perception in Dynamic Environments. CoRR abs/2208.07479 (2022)

Piranha: A GPU Platform for Secure Computation.

Jean-Luc Watson, Sameer Wagh, Raluca Ada Popa: Piranha: A GPU Platform for Secure Computation. USENIX Security Symposium 2022: 827-844

2021

Composing MPC with LQR and Neural Networks for Efficient and Stable Control.

Fangyu Wu, Guanhua Wang, Siyuan Zhuang, Kehan Wang, Alexander Keimer, Ion Stoica, Alexandre M. Bayen: Composing MPC with LQR and Neural Networks for Efficient and Stable Control. CoRR abs/2112.07238 (2021)

2022

LGV: Boosting Adversarial Example Transferability from Large Geometric Vicinity.

Martin Gubri, Maxime Cordy, Mike Papadakis, Yves Le Traon, Koushik Sen: LGV: Boosting Adversarial Example Transferability from Large Geometric Vicinity. CoRR abs/2207.13129 (2022)

The Seattle report on database research.

Daniel Abadi, Anastasia Ailamaki, David G. Andersen, Peter Bailis, Magdalena Balazinska, Philip A. Bernstein, Peter A. Boncz, Surajit Chaudhuri, Alvin Cheung, AnHai Doan, Luna Dong, Michael J. Franklin, Juliana Freire, Alon Y. Halevy, Joseph M. Hellerstein, Stratos Idreos, Donald Kossmann, Tim Kraska, Sailesh Krishnamurthy, Volker Markl, Sergey Melnik, Tova Milo, C. Mohan, Thomas Neumann, Beng Chin Ooi, Fatma Ozcan, Jignesh M. Patel, Andrew Pavlo, Raluca A. Popa, Raghu Ramakrishnan, Christopher Ré, Michael Stonebraker, Dan Suciu: The Seattle report on database research. Commun. ACM 65(8): 72-79 (2022)

ESCHER: expressive scheduling with ephemeral resources.

Romil Bhardwaj, Alexey Tumanov, Stephanie Wang, Richard Liaw, Philipp Moritz, Robert Nishihara, Ion Stoica: ESCHER: expressive scheduling with ephemeral resources. SoCC 2022: 47-62

Making Linear MDPs Practical via Contrastive Representation Learning.

Tianjun Zhang, Tongzheng Ren, Mengjiao Yang, Joseph Gonzalez, Dale Schuurmans, Bo Dai: Making Linear MDPs Practical via Contrastive Representation Learning. ICML 2022: 26447-26466

Autonomously Untangling Long Cables.

Vainavi Viswanath, Kaushik Shivakumar, Justin Kerr, Brijen Thananjeyan, Ellen R. Novoseller, Jeffrey Ichnowski, Alejandro Escontrela, Michael Laskey, Joseph E. Gonzalez, Ken Goldberg: Autonomously Untangling Long Cables. CoRR abs/2207.07813 (2022)

POET: Training Neural Networks on Tiny Devices with Integrated Rematerialization and Paging.

Shishir G. Patil, Paras Jain, Prabal Dutta, Ion Stoica, Joseph E. Gonzalez: POET: Training Neural Networks on Tiny Devices with Integrated Rematerialization and Paging. CoRR abs/2207.07697 (2022)

Making Linear MDPs Practical via Contrastive Representation Learning.

Tianjun Zhang, Tongzheng Ren, Mengjiao Yang, Joseph E. Gonzalez, Dale Schuurmans, Bo Dai: Making Linear MDPs Practical via Contrastive Representation Learning. CoRR abs/2207.07150 (2022)

Alpa: Automating Inter- and Intra-Operator Parallelism for Distributed Deep Learning.

Lianmin Zheng, Zhuohan Li, Hao Zhang, Yonghao Zhuang, Zhifeng Chen, Yanping Huang, Yida Wang, Yuanzhong Xu, Danyang Zhuo, Eric P. Xing, Joseph E. Gonzalez, Ion Stoica: Alpa: Automating Inter- and Intra-Operator Parallelism for Distributed Deep Learning. OSDI 2022: 559-578

Piranha: A GPU Platform for Secure Computation.

Jean-Luc Watson, Sameer Wagh, Raluca Ada Popa: Piranha: A GPU Platform for Secure Computation. IACR Cryptol. ePrint Arch. 2022: 892 (2022)

2021

Untangling Dense Non-Planar Knots by Learning Manipulation Features and Recovery Policies.

Priya Sundaresan, Jennifer Grannen, Brijen Thananjeyan, Ashwin Balakrishna, Jeffrey Ichnowski, Ellen R. Novoseller, Minho Hwang, Michael Laskey, Joseph E. Gonzalez, Ken Goldberg: Untangling Dense Non-Planar Knots by Learning Manipulation Features and Recovery Policies. CoRR abs/2107.08942 (2021)

2022

Neurotoxin: Durable Backdoors in Federated Learning.

Zhengming Zhang, Ashwinee Panda, Linyue Song, Yaoqing Yang, Michael W. Mahoney, Prateek Mittal, Kannan Ramchandran, Joseph Gonzalez: Neurotoxin: Durable Backdoors in Federated Learning. ICML 2022: 26429-26446

NumS: Scalable Array Programming for the Cloud.

Melih Elibol, Vinamra Benara, Samyu Yagati, Lianmin Zheng, Alvin Cheung, Michael I. Jordan, Ion Stoica: NumS: Scalable Array Programming for the Cloud. CoRR abs/2206.14276 (2022)

POET: Training Neural Networks on Tiny Devices with Integrated Rematerialization and Paging.

Shishir G. Patil, Paras Jain, Prabal Dutta, Ion Stoica, Joseph Gonzalez: POET: Training Neural Networks on Tiny Devices with Integrated Rematerialization and Paging. ICML 2022: 17573-17583

Programmatic Modeling and Generation of Real-Time Strategic Soccer Environments for Reinforcement Learning.

Abdus Salam Azad, Edward Kim, Qiancheng Wu, Kimin Lee, Ion Stoica, Pieter Abbeel, Alberto L. Sangiovanni-Vincentelli, Sanjit A. Seshia: Programmatic Modeling and Generation of Real-Time Strategic Soccer Environments for Reinforcement Learning. AAAI 2022: 6028-6036

The Carbon Footprint of Machine Learning Training Will Plateau, Then Shrink.

David A. Patterson, Joseph Gonzalez, Urs Hölzle, Quoc V. Le, Chen Liang, Lluis-Miquel Munguia, Daniel Rothchild, David R. So, Maud Texier, Jeff Dean: The Carbon Footprint of Machine Learning Training Will Plateau, Then Shrink. Computer 55(7): 18-28 (2022)

Treaty: Secure Distributed Transactions.

Dimitra Giantsidi, Maurice Bailleu, Natacha Crooks, Pramod Bhatotia: Treaty: Secure Distributed Transactions. DSN 2022: 14-27

Evaluating natural language processing models with generalization metrics that do not need access to any training or testing data.

Yaoqing Yang, Ryan Theisen, Liam Hodgkinson, Joseph E. Gonzalez, Kannan Ramchandran, Charles H. Martin, Michael W. Mahoney: Evaluating natural language processing models with generalization metrics that do not need access to any training or testing data. CoRR abs/2202.02842 (2022)

On Guiding Visual Attention with Language Specification.

Suzanne Petryk, Lisa Dunlap, Keyan Nasseri, Joseph Gonzalez, Trevor Darrell, Anna Rohrbach: On Guiding Visual Attention with Language Specification. CVPR 2022: 18071-18081

Neurotoxin: Durable Backdoors in Federated Learning.

Zhengming Zhang, Ashwinee Panda, Linyue Song, Yaoqing Yang, Michael W. Mahoney, Joseph E. Gonzalez, Kannan Ramchandran, Prateek Mittal: Neurotoxin: Durable Backdoors in Federated Learning. CoRR abs/2206.10341 (2022)

CostCO: An automatic cost modeling framework for secure multi-party computation.

Vivian Fang, Lloyd Brown, William Lin, Wenting Zheng, Aurojit Panda, Raluca Ada Popa: CostCO: An automatic cost modeling framework for secure multi-party computation. EuroS&P 2022: 140-153

Balsa: Learning a Query Optimizer Without Expert Demonstrations.

Zongheng Yang, Wei-Lin Chiang, Sifei Luan, Gautam Mittal, Michael Luo, Ion Stoica: Balsa: Learning a Query Optimizer Without Expert Demonstrations. SIGMOD Conference 2022: 931-944

It's not easy to relax: liveness in chained BFT protocols.

Ittai Abraham, Natacha Crooks, Neil Giridharan, Heidi Howard, Florian Suri-Payer: It's not easy to relax: liveness in chained BFT protocols. CoRR abs/2205.11652 (2022)

rgpdOS: GDPR Enforcement By The Operating System.

Alain Tchana, Raphael Colin, Adrien Le Berre, Vincent Berger, Benoît Combemale, Natacha Crooks, Ludovic Pailler: rgpdOS: GDPR Enforcement By The Operating System. CoRR abs/2205.10929 (2022)

Waldo: A Private Time-Series Database from Function Secret Sharing.

Emma Dauterman, Mayank Rathee, Raluca Ada Popa, Ion Stoica: Waldo: A Private Time-Series Database from Function Secret Sharing. IEEE Symposium on Security and Privacy 2022: 2450-2468

Efficient and transferable adversarial examples from bayesian neural networks.

Martin Gubri, Maxime Cordy, Mike Papadakis, Yves Le Traon, Koushik Sen: Efficient and transferable adversarial examples from bayesian neural networks. UAI 2022: 738-748

FogROS 2: An Adaptive and Extensible Platform for Cloud and Fog Robotics Using ROS 2.

Jeffrey Ichnowski, Kaiyuan Chen, Karthik Dharmarajan, Simeon Adebola, Michael Danielczuk, Victor Mayoral Vilches, Hugo Zhan, Derek Xu, Ramtin Ghassemi, John Kubiatowicz, Ion Stoica, Joseph Gonzales, Ken Goldberg: FogROS 2: An Adaptive and Extensible Platform for Cloud and Fog Robotics Using ROS 2. CoRR abs/2205.09778 (2022)

Learning to Design Accurate Deep Learning Accelerators with Inaccurate Multipliers.

Paras Jain, Safeen Huda, Martin Maas, Joseph E. Gonzalez, Ion Stoica, Azalia Mirhoseini: Learning to Design Accurate Deep Learning Accelerators with Inaccurate Multipliers. DATE 2022: 184-189

The Sky Above The Clouds.

Sarah E. Chasins, Alvin Cheung, Natacha Crooks, Ali Ghodsi, Ken Goldberg, Joseph E. Gonzalez, Joseph M. Hellerstein, Michael I. Jordan, Anthony D. Joseph, Michael W. Mahoney, Aditya G. Parameswaran, David A. Patterson, Raluca Ada Popa, Koushik Sen, Scott Shenker, Dawn Song, Ion Stoica: The Sky Above The Clouds. CoRR abs/2205.07147 (2022)

2021

Contingencies from Observations: Tractable Contingency Planning with Learned Behavior Models.

Nicholas Rhinehart, Jeff He, Charles Packer, Matthew A. Wright, Rowan McAllister, Joseph E. Gonzalez, Sergey Levine: Contingencies from Observations: Tractable Contingency Planning with Learned Behavior Models. CoRR abs/2104.10558 (2021)

2022

The Carbon Footprint of Machine Learning Training Will Plateau, Then Shrink.

David A. Patterson, Joseph Gonzalez, Urs Hölzle, Quoc V. Le, Chen Liang, Lluis-Miquel Munguia, Daniel Rothchild, David R. So, Maud Texier, Jeff Dean: The Carbon Footprint of Machine Learning Training Will Plateau, Then Shrink. CoRR abs/2204.05149 (2022)

Ekya: Continuous Learning of Video Analytics Models on Edge Compute Servers.

Romil Bhardwaj, Zhengxu Xia, Ganesh Ananthanarayanan, Junchen Jiang, Yuanchao Shu, Nikolaos Karianakis, Kevin Hsieh, Paramvir Bahl, Ion Stoica: Ekya: Continuous Learning of Video Analytics Models on Edge Compute Servers. NSDI 2022: 119-135

NetHint: White-Box Networking for Multi-Tenant Data Centers.

Jingrong Chen, Hong Zhang, Wei Zhang, Liang Luo, Jeffrey S. Chase, Ion Stoica, Danyang Zhuo: NetHint: White-Box Networking for Multi-Tenant Data Centers. NSDI 2022: 1327-1343

D3: a dynamic deadline-driven approach for building autonomous vehicles.

Ionel Gog, Sukrit Kalra, Peter Schafhalter, Joseph E. Gonzalez, Ion Stoica: D3: a dynamic deadline-driven approach for building autonomous vehicles. EuroSys 2022: 453-471

Jiffy: elastic far-memory for stateful serverless analytics.

Anurag Khandelwal, Yupeng Tang, Rachit Agarwal, Aditya Akella, Ion Stoica: Jiffy: elastic far-memory for stateful serverless analytics. EuroSys 2022: 697-713

Learning Competitive Equilibria in Exchange Economies with Bandit Feedback.

Wenshuo Guo, Kirthevasan Kandasamy, Joseph Gonzalez, Michael I. Jordan, Ion Stoica: Learning Competitive Equilibria in Exchange Economies with Bandit Feedback. AISTATS 2022: 6200-6224

CostCO: An automatic cost modeling framework for secure multi-party computation.

Vivian Fang, Lloyd Brown, William Lin, Wenting Zheng, Aurojit Panda, Raluca Ada Popa: CostCO: An automatic cost modeling framework for secure multi-party computation. IACR Cryptol. ePrint Arch. 2022: 332 (2022)

All You Need is LUV: Unsupervised Collection of Labeled Images using Invisible UV Fluorescent Indicators.

Brijen Thananjeyan, Justin Kerr, Huang Huang, Joseph E. Gonzalez, Ken Goldberg: All You Need is LUV: Unsupervised Collection of Labeled Images using Invisible UV Fluorescent Indicators. CoRR abs/2203.04566 (2022)

Exoshuffle: Large-Scale Shuffle at the Application Level.

Frank Sifei Luan, Stephanie Wang, Samyukta Yagati, Sean Kim, Kenneth Lien, SangBin Cho, Eric Liang, Ion Stoica: Exoshuffle: Large-Scale Shuffle at the Application Level. CoRR abs/2203.05072 (2022)

How Computer Science and Statistics Instructors Approach Data Science Pedagogy Differently: Three Case Studies.

Sam Lau, Deborah Nolan, Joseph Gonzalez, Philip J. Guo: How Computer Science and Statistics Instructors Approach Data Science Pedagogy Differently: Three Case Studies. SIGCSE (1) 2022: 29-35

On Guiding Visual Attention with Language Specification.

Suzanne Petryk, Lisa Dunlap, Keyan Nasseri, Joseph Gonzalez, Trevor Darrell, Anna Rohrbach: On Guiding Visual Attention with Language Specification. CoRR abs/2202.08926 (2022)

Dissecting BFT Consensus: In Trusted Components we Trust!

Suyash Gupta, Sajjad Rahnama, Shubham Pandey, Natacha Crooks, Mohammad Sadoghi: Dissecting BFT Consensus: In Trusted Components we Trust! CoRR abs/2202.01354 (2022)

A Review of Single-Source Deep Unsupervised Visual Domain Adaptation.

Sicheng Zhao, Xiangyu Yue, Shanghang Zhang, Bo Li, Han Zhao, Bichen Wu, Ravi Krishna, Joseph E. Gonzalez, Alberto L. Sangiovanni-Vincentelli, Sanjit A. Seshia, Kurt Keutzer: A Review of Single-Source Deep Unsupervised Visual Domain Adaptation. IEEE Trans. Neural Networks Learn. Syst. 33(2): 473-493 (2022)

Alpa: Automating Inter- and Intra-Operator Parallelism for Distributed Deep Learning.

Lianmin Zheng, Zhuohan Li, Hao Zhang, Yonghao Zhuang, Zhifeng Chen, Yanping Huang, Yida Wang, Yuanzhong Xu, Danyang Zhuo, Joseph E. Gonzalez, Ion Stoica: Alpa: Automating Inter- and Intra-Operator Parallelism for Distributed Deep Learning. CoRR abs/2201.12023 (2022)

C-Planning: An Automatic Curriculum for Learning Goal-Reaching Tasks.

Tianjun Zhang, Benjamin Eysenbach, Ruslan Salakhutdinov, Sergey Levine, Joseph E. Gonzalez: C-Planning: An Automatic Curriculum for Learning Goal-Reaching Tasks. ICLR 2022

Data Efficient Language-Supervised Zero-Shot Recognition with Optimal Transport Distillation.

Bichen Wu, Ruizhe Cheng, Peizhao Zhang, Tianren Gao, Joseph E. Gonzalez, Peter Vajda: Data Efficient Language-Supervised Zero-Shot Recognition with Optimal Transport Distillation. ICLR 2022

Representing Long-Range Context for Graph Neural Networks with Global Attention.

Zhanghao Wu, Paras Jain, Matthew A. Wright, Azalia Mirhoseini, Joseph E. Gonzalez, Ion Stoica: Representing Long-Range Context for Graph Neural Networks with Global Attention. CoRR abs/2201.08821 (2022)

Balsa: Learning a Query Optimizer Without Expert Demonstrations.

Zongheng Yang, Wei-Lin Chiang, Sifei Luan, Gautam Mittal, Michael Luo, Ion Stoica: Balsa: Learning a Query Optimizer Without Expert Demonstrations. CoRR abs/2201.01441 (2022)

2021

Waldo: A Private Time-Series Database from Function Secret Sharing.

Emma Dauterman, Mayank Rathee, Raluca Ada Popa, Ion Stoica: Waldo: A Private Time-Series Database from Function Secret Sharing. IACR Cryptol. ePrint Arch. 2021: 1661 (2021)

Data Efficient Language-supervised Zero-shot Recognition with Optimal Transport Distillation.

Bichen Wu, Ruizhe Cheng, Peizhao Zhang, Peter Vajda, Joseph E. Gonzalez: Data Efficient Language-supervised Zero-shot Recognition with Optimal Transport Distillation. CoRR abs/2112.09445 (2021)

Improving Semi-supervised Federated Learning by Reducing the Gradient Diversity of Models.

Zhengming Zhang, Yaoqing Yang, Zhewei Yao, Yujun Yan, Joseph E. Gonzalez, Kannan Ramchandran, Michael W. Mahoney: Improving Semi-supervised Federated Learning by Reducing the Gradient Diversity of Models. IEEE BigData 2021: 1214-1225

Gemmini: Enabling Systematic Deep-Learning Architecture Evaluation via Full-Stack Integration.

Hasan Genc, Seah Kim, Alon Amid, Ameer Haj-Ali, Vighnesh Iyer, Pranav Prakash, Jerry Zhao, Daniel Grubb, Harrison Liew, Howard Mao, Albert J. Ou, Colin Schmidt, Samuel Steffl, John Charles Wright, Ion Stoica, Jonathan Ragan-Kelley, Krste Asanovic, Borivoje Nikolic, Yakun Sophia Shao: Gemmini: Enabling Systematic Deep-Learning Architecture Evaluation via Full-Stack Integration. DAC 2021: 769-774

The Effect of Model Size on Worst-Group Generalization.

Alan Pham, Eunice Chan, Vikranth Srivatsa, Dhruba Ghosh, Yaoqing Yang, Yaodong Yu, Ruiqi Zhong, Joseph E. Gonzalez, Jacob Steinhardt: The Effect of Model Size on Worst-Group Generalization. CoRR abs/2112.04094 (2021)

Accelerating Quadratic Optimization with Reinforcement Learning.

Jeffrey Ichnowski, Paras Jain, Bartolomeo Stellato, Goran Banjac, Michael Luo, Francesco Borrelli, Joseph E. Gonzalez, Ion Stoica, Ken Goldberg: Accelerating Quadratic Optimization with Reinforcement Learning. NeurIPS 2021: 21043-21055

Hindsight Task Relabelling: Experience Replay for Sparse Reward Meta-RL.

Charles Packer, Pieter Abbeel, Joseph E. Gonzalez: Hindsight Task Relabelling: Experience Replay for Sparse Reward Meta-RL. NeurIPS 2021: 2466-2477

NovelD: A Simple yet Effective Exploration Criterion.

Tianjun Zhang, Huazhe Xu, Xiaolong Wang, Yi Wu, Kurt Keutzer, Joseph E. Gonzalez, Yuandong Tian: NovelD: A Simple yet Effective Exploration Criterion. NeurIPS 2021: 25217-25230

TenSet: A Large-scale Program Performance Dataset for Learned Tensor Compilers.

Lianmin Zheng, Ruochen Liu, Junru Shao, Tianqi Chen, Joseph Gonzalez, Ion Stoica, Ameer Haj-Ali: TenSet: A Large-scale Program Performance Dataset for Learned Tensor Compilers. NeurIPS Datasets and Benchmarks 2021

Hindsight Task Relabelling: Experience Replay for Sparse Reward Meta-RL.

Charles Packer, Pieter Abbeel, Joseph E. Gonzalez: Hindsight Task Relabelling: Experience Replay for Sparse Reward Meta-RL. CoRR abs/2112.00901 (2021)

HOLMES: A Platform for Detecting Malicious Inputs in Secure Collaborative Computation.

Weikeng Chen, Katerina Sotiraki, Ian Chang, Murat Kantarcioglu, Raluca Ada Popa: HOLMES: A Platform for Detecting Malicious Inputs in Secure Collaborative Computation. IACR Cryptol. ePrint Arch. 2021: 1517 (2021)

VizSmith: Automated Visualization Synthesis by Mining Data-Science Notebooks.

Rohan Bavishi, Shadaj Laddad, Hiroaki Yoshida, Mukul R. Prasad, Koushik Sen: VizSmith: Automated Visualization Synthesis by Mining Data-Science Notebooks. ASE 2021: 129-141

Taxonomizing local versus global structure in neural network loss landscapes.

Yaoqing Yang, Liam Hodgkinson, Ryan Theisen, Joe Zou, Joseph E. Gonzalez, Kannan Ramchandran, Michael W. Mahoney: Taxonomizing local versus global structure in neural network loss landscapes. NeurIPS 2021: 18722-18733

Contrastive Code Representation Learning.

Paras Jain, Ajay Jain, Tianjun Zhang, Pieter Abbeel, Joseph Gonzalez, Ion Stoica: Contrastive Code Representation Learning. EMNLP (1) 2021: 5954-5971

Grounded Graph Decoding Improves Compositional Generalization in Question Answering.

Yu Gai, Paras Jain, Wendi Zhang, Joseph E. Gonzalez, Dawn Song, Ion Stoica: Grounded Graph Decoding Improves Compositional Generalization in Question Answering. CoRR abs/2111.03642 (2021)

Elastic Hyperparameter Tuning on the Cloud.

Lisa Dunlap, Kirthevasan Kandasamy, Ujval Misra, Richard Liaw, Michael I. Jordan, Ion Stoica, Joseph E. Gonzalez: Elastic Hyperparameter Tuning on the Cloud. SoCC 2021: 33-46

Flexible Rule-Based Decomposition and Metadata Independence in Modin: A Parallel Dataframe System.

Devin Petersohn, Dixin Tang, Rehan Sohail Durrani, Areg Melik-Adamyan, Joseph Gonzalez, Anthony D. Joseph, Aditya G. Parameswaran: Flexible Rule-Based Decomposition and Metadata Independence in Modin: A Parallel Dataframe System. Proc. VLDB Endow. 15(3): 739-751 (2021)

Grounded Graph Decoding improves Compositional Generalization in Question Answering.

Yu Gai, Paras Jain, Wendi Zhang, Joseph Gonzalez, Dawn Song, Ion Stoica: Grounded Graph Decoding improves Compositional Generalization in Question Answering. EMNLP (Findings) 2021: 1829-1838

Basil: Breaking up BFT with ACID (transactions).

Florian Suri-Payer, Matthew Burke, Zheng Wang, Yunhao Zhang, Lorenzo Alvisi, Natacha Crooks: Basil: Breaking up BFT with ACID (transactions). SOSP 2021: 1-17

Snoopy: Surpassing the Scalability Bottleneck of Oblivious Storage.

Emma Dauterman, Vivian Fang, Ioannis Demertzis, Natacha Crooks, Raluca Ada Popa: Snoopy: Surpassing the Scalability Bottleneck of Oblivious Storage. SOSP 2021: 655-671

C-Planning: An Automatic Curriculum for Learning Goal-Reaching Tasks.

Tianjun Zhang, Benjamin Eysenbach, Ruslan Salakhutdinov, Sergey Levine, Joseph E. Gonzalez: C-Planning: An Automatic Curriculum for Learning Goal-Reaching Tasks. CoRR abs/2110.12080 (2021)

Robust Object Detection via Instance-Level Temporal Cycle Confusion.

Xin Wang, Thomas E. Huang, Benlin Liu, Fisher Yu, Xiaolong Wang, Joseph E. Gonzalez, Trevor Darrell: Robust Object Detection via Instance-Level Temporal Cycle Confusion. ICCV 2021: 9123-9132

Gauss: program synthesis by reasoning over graphs.

Rohan Bavishi, Caroline Lemieux, Koushik Sen, Ion Stoica: Gauss: program synthesis by reasoning over graphs. Proc. ACM Program. Lang. 5(OOPSLA): 1-29 (2021)

Visual Transformers: Where Do Transformers Really Belong in Vision Models?

Bichen Wu, Chenfeng Xu, Xiaoliang Dai, Alvin Wan, Peizhao Zhang, Zhicheng Yan, Masayoshi Tomizuka, Joseph Gonzalez, Kurt Keutzer, Peter Vajda: Visual Transformers: Where Do Transformers Really Belong in Vision Models? ICCV 2021: 579-589

No-Commit Proofs: Defeating Livelock in BFT.

Neil Giridharan, Heidi Howard, Ittai Abraham, Natacha Crooks, Alin Tomescu: No-Commit Proofs: Defeating Livelock in BFT. IACR Cryptol. ePrint Arch. 2021: 1308 (2021)

Disentangling Dense Multi-Cable Knots.

Vainavi Viswanath, Jennifer Grannen, Priya Sundaresan, Brijen Thananjeyan, Ashwin Balakrishna, Ellen R. Novoseller, Jeffrey Ichnowski, Michael Laskey, Joseph E. Gonzalez, Ken Goldberg: Disentangling Dense Multi-Cable Knots. IROS 2021: 3731-3738

Basil: Breaking up BFT with ACID (transactions).

Florian Suri-Payer, Matthew Burke, Zheng Wang, Yunhao Zhang, Lorenzo Alvisi, Natacha Crooks: Basil: Breaking up BFT with ACID (transactions). CoRR abs/2109.12443 (2021)

Snoopy: Surpassing the Scalability Bottleneck of Oblivious Storage.

Emma Dauterman, Vivian Fang, Ioannis Demertzis, Natacha Crooks, Raluca Ada Popa: Snoopy: Surpassing the Scalability Bottleneck of Oblivious Storage. IACR Cryptol. ePrint Arch. 2021: 1280 (2021)

LS3: Latent Space Safe Sets for Long-Horizon Visuomotor Control of Sparse Reward Iterative Tasks.

Albert Wilcox, Ashwin Balakrishna, Brijen Thananjeyan, Joseph E. Gonzalez, Ken Goldberg: LS3: Latent Space Safe Sets for Long-Horizon Visuomotor Control of Sparse Reward Iterative Tasks. CoRL 2021: 959-969

2022

TAOBench: An End-to-End Benchmark for Social Networking Workloads.

Audrey Cheng, Xiao Shi, Aaron N. Kabcenell, Shilpa Lawande, Hamza Qadeer, Jason Chan, Harrison Tin, Ryan Zhao, Peter Bailis, Mahesh Balakrishnan, Nathan Bronson, Natacha Crooks, Ion Stoica: TAOBench: An End-to-End Benchmark for Social Networking Workloads. Proc. VLDB Endow. 15(9): 1965-1977 (2022)

2021

[Solution] Matchmaker Paxos: A Reconfigurable Consensus Protocol.

Michael J. Whittaker, Neil Giridharan, Adriana Szekeres, Joseph M. Hellerstein, Heidi Howard, Faisal Nawab, Ion Stoica: [Solution] Matchmaker Paxos: A Reconfigurable Consensus Protocol. J. Syst. Res. 1(1) (2021)

SoK: A Generalized Multi-Leader State Machine Replication Tutorial.

Michael J. Whittaker, Neil Giridharan, Adriana Szekeres, Joseph M. Hellerstein, Ion Stoica: SoK: A Generalized Multi-Leader State Machine Replication Tutorial. J. Syst. Res. 1(1) (2021)

Learning Highly Recursive Input Grammars.

Neil Kulkarni, Caroline Lemieux, Koushik Sen: Learning Highly Recursive Input Grammars. CoRR abs/2108.13340 (2021)

FogROS: An Adaptive Framework for Automating Fog Robotics Deployment.

Kaiyuan Chen, Yafei Liang, Nikhil Jha, Jeffrey Ichnowski, Michael Danielczuk, Joseph Gonzalez, John Kubiatowicz, Ken Goldberg: FogROS: An Adaptive Framework for Automating Fog Robotics Deployment. CASE 2021: 2035-2042

FogROS: An Adaptive Framework for Automating Fog Robotics Deployment.

Kaiyuan Chen, Yafei Liang, Nikhil Jha, Jeffrey Ichnowski, Michael Danielczuk, Joseph Gonzalez, John Kubiatowicz, Ken Goldberg: FogROS: An Adaptive Framework for Automating Fog Robotics Deployment. CoRR abs/2108.11355 (2021)

C5T5: Controllable Generation of Organic Molecules with Transformers.

Daniel Rothchild, Alex Tamkin, Julie Yu, Ujval Misra, Joseph Gonzalez: C5T5: Controllable Generation of Organic Molecules with Transformers. CoRR abs/2108.10307 (2021)

Simple and Automatic Distributed Machine Learning on Ray.

Hao Zhang, Zhuohan Li, Lianmin Zheng, Ion Stoica: Simple and Automatic Distributed Machine Learning on Ray. KDD 2021: 4094-4095

Benchmark of Bitrate Adaptation in Video Streaming.

Jessica Chen, Henry Milner, Ion Stoica, Jibin Zhan: Benchmark of Bitrate Adaptation in Video Streaming. ACM J. Data Inf. Qual. 13(4): 22:1-22:24 (2021)

Cerebro: A Platform for Multi-Party Cryptographic Collaborative Learning.

Wenting Zheng, Ryan Deng, Weikeng Chen, Raluca Ada Popa, Aurojit Panda, Ion Stoica: Cerebro: A Platform for Multi-Party Cryptographic Collaborative Learning. USENIX Security Symposium 2021: 2723-2740

Senate: A Maliciously-Secure MPC Platform for Collaborative Analytics.

Rishabh Poddar, Sukrit Kalra, Avishay Yanai, Ryan Deng, Raluca Ada Popa, Joseph M. Hellerstein: Senate: A Maliciously-Secure MPC Platform for Collaborative Analytics. USENIX Security Symposium 2021: 2129-2146

Hoplite: efficient and fault-tolerant collective communication for task-based distributed systems.

Siyuan Zhuang, Zhuohan Li, Danyang Zhuo, Stephanie Wang, Eric Liang, Robert Nishihara, Philipp Moritz, Ion Stoica: Hoplite: efficient and fault-tolerant collective communication for task-based distributed systems. SIGCOMM 2021: 641-656

Taxonomizing local versus global structure in neural network loss landscapes.

Yaoqing Yang, Liam Hodgkinson, Ryan Theisen, Joe Zou, Joseph E. Gonzalez, Kannan Ramchandran, Michael W. Mahoney: Taxonomizing local versus global structure in neural network loss landscapes. CoRR abs/2107.11228 (2021)

Accelerating Quadratic Optimization with Reinforcement Learning.

Jeffrey Ichnowski, Paras Jain, Bartolomeo Stellato, Goran Banjac, Michael Luo, Francesco Borrelli, Joseph E. Gonzalez, Ion Stoica, Ken Goldberg: Accelerating Quadratic Optimization with Reinforcement Learning. CoRR abs/2107.10847 (2021)

ActNN: Reducing Training Memory Footprint via 2-Bit Activation Compressed Training.

Jianfei Chen, Lianmin Zheng, Zhewei Yao, Dequan Wang, Ion Stoica, Michael W. Mahoney, Joseph Gonzalez: ActNN: Reducing Training Memory Footprint via 2-Bit Activation Compressed Training. ICML 2021: 1803-1813

TeraPipe: Token-Level Pipeline Parallelism for Training Large-Scale Language Models.

Zhuohan Li, Siyuan Zhuang, Shiyuan Guo, Danyang Zhuo, Hao Zhang, Dawn Song, Ion Stoica: TeraPipe: Token-Level Pipeline Parallelism for Training Large-Scale Language Models. ICML 2021: 6543-6552

Untangling Dense Non-Planar Knots by Learning Manipulation Features and Recovery Policies.

Priya Sundaresan, Jennifer Grannen, Brijen Thananjeyan, Ashwin Balakrishna, Jeffrey Ichnowski, Ellen R. Novoseller, Minho Hwang, Michael Laskey, Joseph Gonzalez, Ken Goldberg: Untangling Dense Non-Planar Knots by Learning Manipulation Features and Recovery Policies. Robotics: Science and Systems 2021

LS3: Latent Space Safe Sets for Long-Horizon Visuomotor Control of Iterative Tasks.

Albert Wilcox, Ashwin Balakrishna, Brijen Thananjeyan, Joseph E. Gonzalez, Ken Goldberg: LS3: Latent Space Safe Sets for Long-Horizon Visuomotor Control of Iterative Tasks. CoRR abs/2107.04775 (2021)

Scaling Replicated State Machines with Compartmentalization.

Michael J. Whittaker, Ailidani Ailijiang, Aleksey Charapko, Murat Demirbas, Neil Giridharan, Joseph M. Hellerstein, Heidi Howard, Ion Stoica, Adriana Szekeres: Scaling Replicated State Machines with Compartmentalization. Proc. VLDB Endow. 14(11): 2203-2215 (2021)

Data-Efficient Language-Supervised Zero-Shot Learning With Self-Distillation.

Ruizhe Cheng, Bichen Wu, Peizhao Zhang, Peter Vajda, Joseph E. Gonzalez: Data-Efficient Language-Supervised Zero-Shot Learning With Self-Distillation. CVPR Workshops 2021: 3119-3124

FBNetV3: Joint Architecture-Recipe Search Using Predictor Pretraining.

Ruizhe Cheng, Bichen Wu, Peizhao Zhang, Peter Vajda, Joseph E. Gonzalez: Data-Efficient Language-Supervised Zero-Shot Learning With Self-Distillation. CVPR Workshops 2021: 3119-3124

A Client-centric Approach to Transactional Datastores.

Natacha Crooks: A Client-centric Approach to Transactional Datastores. SIGMOD Conference 2021: 3-5

Scenic4RL: Programmatic Modeling and Generation of Reinforcement Learning Environments.

Abdus Salam Azad, Edward Kim, Qiancheng Wu, Kimin Lee, Ion Stoica, Pieter Abbeel, Sanjit A. Seshia: Scenic4RL: Programmatic Modeling and Generation of Reinforcement Learning Environments. CoRR abs/2106.10365 (2021)

CathAI: Fully Automated Interpretation of Coronary Angiograms Using Neural Networks.

Robert Avram, Jeffrey E. Olgin, Alvin Wan, Zeeshan Ahmed, Louis Verreault-Julien, Sean Abreau, Derek Wan, Joseph E. Gonzalez, Derek Y. So, Krishan Soni, Geoffrey H. Tison: CathAI: Fully Automated Interpretation of Coronary Angiograms Using Neural Networks. CoRR abs/2106.07708 (2021)

Cerebro: A Platform for Multi-Party Cryptographic Collaborative Learning.

Wenting Zheng, Ryan Deng, Weikeng Chen, Raluca Ada Popa, Aurojit Panda, Ion Stoica: Cerebro: A Platform for Multi-Party Cryptographic Collaborative Learning. IACR Cryptol. ePrint Arch. 2021: 759 (2021)

Intermittent Visual Servoing: Efficiently Learning Policies Robust to Instrument Changes for High-precision Surgical Manipulation.

Samuel Paradis, Minho Hwang, Brijen Thananjeyan, Jeffrey Ichnowski, Daniel Seita, Danyal Fer, Thomas Low, Joseph E. Gonzalez, Ken Goldberg: Intermittent Visual Servoing: Efficiently Learning Policies Robust to Instrument Changes for High-precision Surgical Manipulation. ICRA 2021: 7166-7173

Disentangling Dense Multi-Cable Knots.

Vainavi Viswanath, Jennifer Grannen, Priya Sundaresan, Brijen Thananjeyan, Ashwin Balakrishna, Ellen R. Novoseller, Jeffrey Ichnowski, Michael Laskey, Joseph E. Gonzalez, Ken Goldberg: Disentangling Dense Multi-Cable Knots. CoRR abs/2106.02252 (2021)

From cloud computing to sky computing.

Ion Stoica, Scott Shenker: From cloud computing to sky computing. HotOS 2021: 26-32

In reference to RPC: it's time to add distributed memory.

Stephanie Wang, Benjamin Hindman, Ion Stoica: In reference to RPC: it's time to add distributed memory. HotOS 2021: 191-198

The RESTless cloud.

Nathan Pemberton, Johann Schleier-Smith, Joseph E. Gonzalez: The RESTless cloud. HotOS 2021: 49-57

Transformers are Deep Infinite-Dimensional Non-Mercer Binary Kernel Machines.

Matthew A. Wright, Joseph E. Gonzalez: Transformers are Deep Infinite-Dimensional Non-Mercer Binary Kernel Machines. CoRR abs/2106.01506 (2021)

Serverless Multi-Query Motion Planning for Fog Robotics.

Raghav Anand, Jeffrey Ichnowski, Chenggang Wu, Joseph M. Hellerstein, Joseph E. Gonzalez, Ken Goldberg: Serverless Multi-Query Motion Planning for Fog Robotics. ICRA 2021: 7457-7463

Contingencies from Observations: Tractable Contingency Planning with Learned Behavior Models.

Nicholas Rhinehart, Jeff He, Charles Packer, Matthew A. Wright, Rowan McAllister, Joseph E. Gonzalez, Sergey Levine: Contingencies from Observations: Tractable Contingency Planning with Learned Behavior Models. ICRA 2021: 13663-13669

Growing A Test Corpus with Bonsai Fuzzing.

Vasudev Vikram, Rohan Padhye, Koushik Sen: Growing A Test Corpus with Bonsai Fuzzing. ICSE 2021: 723-735

Learning Dense Visual Correspondences in Simulation to Smooth and Fold Real Fabrics.

Aditya Ganapathi, Priya Sundaresan, Brijen Thananjeyan, Ashwin Balakrishna, Daniel Seita, Jennifer Grannen, Minho Hwang, Ryan Hoque, Joseph E. Gonzalez, Nawid Jamali, Katsu Yamane, Soshi Iba, Ken Goldberg: Learning Dense Visual Correspondences in Simulation to Smooth and Fold Real Fabrics. ICRA 2021: 11515-11522

Merkle2: A Low-Latency Transparency Log System.

Yuncong Hu, Kian Hooshmand, Harika Kalidhindi, Seung Jin Yang, Raluca Ada Popa: Merkle2: A Low-Latency Transparency Log System. IEEE Symposium on Security and Privacy 2021: 285-303

Revitalizing the public internet by making it extensible.

Hari Balakrishnan, Sujata Banerjee, Israel Cidon, David E. Culler, Deborah Estrin, Ethan Katz-Bassett, Arvind Krishnamurthy, James Murphy McCauley, Nick McKeown, Aurojit Panda, Sylvia Ratnasamy, Jennifer Rexford, Michael Schapira, Scott Shenker, Ion Stoica, David L. Tennenhouse, Amin Vahdat, Ellen W. Zegura: Revitalizing the public internet by making it extensible. Comput. Commun. Rev. 51(2): 18-24 (2021)

ActNN: Reducing Training Memory Footprint via 2-Bit Activation Compressed Training.

Jianfei Chen, Lianmin Zheng, Zhewei Yao, Dequan Wang, Ion Stoica, Michael W. Mahoney, Joseph E. Gonzalez: ActNN: Reducing Training Memory Footprint via 2-Bit Activation Compressed Training. CoRR abs/2104.14129 (2021)

What serverless computing is and should become: the next phase of cloud computing.

Johann Schleier-Smith, Vikram Sreekanti, Anurag Khandelwal, João Carreira, Neeraja Jayant Yadwadkar, Raluca Ada Popa, Joseph E. Gonzalez, Ion Stoica, David A. Patterson: What serverless computing is and should become: the next phase of cloud computing. Commun. ACM 64(5): 76-84 (2021)

Carbon Emissions and Large Neural Network Training.

David A. Patterson, Joseph Gonzalez, Quoc V. Le, Chen Liang, Lluis-Miquel Munguia, Daniel Rothchild, David R. So, Maud Texier, Jeff Dean: Carbon Emissions and Large Neural Network Training. CoRR abs/2104.10350 (2021)

RubberBand: cloud-based hyperparameter tuning.

Ujval Misra, Richard Liaw, Lisa Dunlap, Romil Bhardwaj, Kirthevasan Kandasamy, Joseph E. Gonzalez, Ion Stoica, Alexey Tumanov: RubberBand: cloud-based hyperparameter tuning. EuroSys 2021: 327-342

Data-Efficient Language-Supervised Zero-Shot Learning with Self-Distillation.

Ruizhe Cheng, Bichen Wu, Peizhao Zhang, Peter Vajda, Joseph E. Gonzalez: Data-Efficient Language-Supervised Zero-Shot Learning with Self-Distillation. CoRR abs/2104.08945 (2021)

Robust Object Detection via Instance-Level Temporal Cycle Confusion.

Xin Wang, Thomas E. Huang, Benlin Liu, Fisher Yu, Xiaolong Wang, Joseph E. Gonzalez, Trevor Darrell: Robust Object Detection via Instance-Level Temporal Cycle Confusion. CoRR abs/2104.08381 (2021)

Caerus: NIMBLE Task Scheduling for Serverless Analytics.

Hong Zhang, Yupeng Tang, Anurag Khandelwal, Jingrong Chen, Ion Stoica: Caerus: NIMBLE Task Scheduling for Serverless Analytics. NSDI 2021: 653-669

Ownership: A Distributed Futures System for Fine-Grained Tasks.

Stephanie Wang, Eric Liang, Edward Oakes, Benjamin Hindman, Frank Sifei Luan, Audrey Cheng, Ion Stoica: Ownership: A Distributed Futures System for Fine-Grained Tasks. NSDI 2021: 671-686

TEGRA: Efficient Ad-Hoc Analytics on Evolving Graphs.

Anand Padmanabha Iyer, Qifan Pu, Kishan Patel, Joseph E. Gonzalez, Ion Stoica: TEGRA: Efficient Ad-Hoc Analytics on Evolving Graphs. NSDI 2021: 337-355

Twenty Years After: Hierarchical Core-Stateless Fair Queueing.

Zhuolong Yu, Jingfeng Wu, Vladimir Braverman, Ion Stoica, Xin Jin: Twenty Years After: Hierarchical Core-Stateless Fair Queueing. NSDI 2021: 29-45

Proceedings of Machine Learning and Systems 2021, MLSys 2021, virtual, April 5-9, 2021.

Alex Smola, Alex Dimakis, Ion Stoica: Proceedings of Machine Learning and Systems 2021, MLSys 2021, virtual, April 5-9, 2021. mlsys.org 2021 [contents]

sensAI: ConvNets Decomposition via Class Parallelism for Fast Inference on Live Data.

Guanhua Wang, Zhuang Liu, Brandon Hsieh, Siyuan Zhuang, Joseph Gonzalez, Trevor Darrell, Ion Stoica: sensAI: ConvNets Decomposition via Class Parallelism for Fast Inference on Live Data. MLSys 2021

Wavelet: Efficient DNN Training with Tick-Tock Scheduling.

Guanhua Wang, Kehan Wang, Kenan Jiang, Xiangjun Li, Ion Stoica: Wavelet: Efficient DNN Training with Tick-Tock Scheduling. MLSys 2021

Recovery RL: Safe Reinforcement Learning With Learned Recovery Zones.

Brijen Thananjeyan, Ashwin Balakrishna, Suraj Nair, Michael Luo, Krishnan Srinivasan, Minho Hwang, Joseph E. Gonzalez, Julian Ibarz, Chelsea Finn, Ken Goldberg: Recovery RL: Safe Reinforcement Learning With Learned Recovery Zones. IEEE Robotics Autom. Lett. 6(3): 4915-4922 (2021)

Growing a Test Corpus with Bonsai Fuzzing.

Vasudev Vikram, Rohan Padhye, Koushik Sen: Growing a Test Corpus with Bonsai Fuzzing. CoRR abs/2103.04388 (2021)

Enhancing the Interactivity of Dataframe Queries by Leveraging Think Time.

Doris Xin, Devin Petersohn, Dixin Tang, Yifan Wu, Joseph E. Gonzalez, Joseph M. Hellerstein, Anthony D. Joseph, Aditya G. Parameswaran: Enhancing the Interactivity of Dataframe Queries by Leveraging Think Time. CoRR abs/2103.02145 (2021)

Enhancing the Interactivity of Dataframe Queries by Leveraging Think Time.

Doris Xin, Devin Petersohn, Dixin Tang, Yifan Wu, Joseph E. Gonzalez, Joseph M. Hellerstein, Anthony D. Joseph, Aditya G. Parameswaran: Enhancing the Interactivity of Dataframe Queries by Leveraging Think Time. IEEE Data Eng. Bull. 44(1): 66-78 (2021)

TeraPipe: Token-Level Pipeline Parallelism for Training Large-Scale Language Models.

Zhuohan Li, Siyuan Zhuang, Shiyuan Guo, Danyang Zhuo, Hao Zhang, Dawn Song, Ion Stoica: TeraPipe: Token-Level Pipeline Parallelism for Training Large-Scale Language Models. CoRR abs/2102.07988 (2021)

ABC-LMPC: Safe Sample-Based Learning MPC for Stochastic Nonlinear Dynamical Systems with Adjustable Boundary Conditions.

Brijen Thananjeyan, Ashwin Balakrishna, Ugo Rosolia, Joseph E. Gonzalez, Aaron D. Ames, Ken Goldberg: ABC-LMPC: Safe Sample-Based Learning MPC for Stochastic Nonlinear Dynamical Systems with Adjustable Boundary Conditions. WAFR 2021: 1-17

Remembering for the Right Reasons: Explanations Reduce Catastrophic Forgetting.

Sayna Ebrahimi, Suzanne Petryk, Akash Gokul, William Gan, Joseph E. Gonzalez, Marcus Rohrbach, Trevor Darrell: Remembering for the Right Reasons: Explanations Reduce Catastrophic Forgetting. ICLR 2021

FairFuzz-TC: a fuzzer targeting rare branches.

Caroline Lemieux, Koushik Sen: FairFuzz-TC: a fuzzer targeting rare branches. Int. J. Softw. Tools Technol. Transf. 23(6): 863-866 (2021)

2026

Rollbaccine: Herd Immunity against Storage Rollback Attacks in TEEs.

David C. Y. Chu, Aditya Balasubramanian, Dee Bao, Natacha Crooks, Heidi Howard, Lucky Katahanas, Soujanya Ponnapalli: Rollbaccine: Herd Immunity against Storage Rollback Attacks in TEEs. Proc. ACM Manag. Data 4(1): 79:1-79:27 (2026)

2021

Learning Highly Recursive Input Grammars.

Neil Kulkarni, Caroline Lemieux, Koushik Sen: Learning Highly Recursive Input Grammars. ASE 2021: 456-467

Learning Space Partitions for Path Planning.

Kevin Yang, Tianjun Zhang, Chris Cummins, Brandon Cui, Benoit Steiner, Linnan Wang, Joseph E. Gonzalez, Dan Klein, Yuandong Tian: Learning Space Partitions for Path Planning. NeurIPS 2021: 378-391

Learning Space Partitions for Path Planning.

Kevin Yang, Tianjun Zhang, Chris Cummins, Brandon Cui, Benoit Steiner, Linnan Wang, Joseph E. Gonzalez, Dan Klein, Yuandong Tian: Learning Space Partitions for Path Planning. CoRR abs/2106.10544 (2021)

MADE: Exploration via Maximizing Deviation from Explored Regions.

Tianjun Zhang, Paria Rashidinejad, Jiantao Jiao, Yuandong Tian, Joseph Gonzalez, Stuart Russell: MADE: Exploration via Maximizing Deviation from Explored Regions. CoRR abs/2106.10268 (2021)

MADE: Exploration via Maximizing Deviation from Explored Regions.

Tianjun Zhang, Paria Rashidinejad, Jiantao Jiao, Yuandong Tian, Joseph E. Gonzalez, Stuart Russell: MADE: Exploration via Maximizing Deviation from Explored Regions. NeurIPS 2021: 9663-9680

MAGE: Nearly Zero-Cost Virtual Memory for Secure Computation.

Sam Kumar, David E. Culler, Raluca Ada Popa: MAGE: Nearly Zero-Cost Virtual Memory for Secure Computation. CoRR abs/2106.14651 (2021)

MAGE: Nearly Zero-Cost Virtual Memory for Secure Computation.

Sam Kumar, David E. Culler, Raluca Ada Popa: MAGE: Nearly Zero-Cost Virtual Memory for Secure Computation. OSDI 2021: 367-385

Merkle^2: A Low-Latency Transparency Log System.

Yuncong Hu, Kian Hooshmand, Harika Kalidhindi, Seung Jin Yang, Raluca Ada Popa: Merkle^2: A Low-Latency Transparency Log System. IACR Cryptol. ePrint Arch. 2021: 453 (2021)

MESA: Offline Meta-RL for Safe Adaptation and Fault Tolerance.

Michael Luo, Ashwin Balakrishna, Brijen Thananjeyan, Suraj Nair, Julian Ibarz, Jie Tan, Chelsea Finn, Ion Stoica, Ken Goldberg: MESA: Offline Meta-RL for Safe Adaptation and Fault Tolerance. CoRR abs/2112.03575 (2021)

MUSE: Secure Inference Resilient to Malicious Clients.

Ryan Lehmkuhl, Pratyush Mishra, Akshayaram Srinivasan, Raluca Ada Popa: MUSE: Secure Inference Resilient to Malicious Clients. IACR Cryptol. ePrint Arch. 2021: 1040 (2021)

Muse: Secure Inference Resilient to Malicious Clients.

Ryan Lehmkuhl, Pratyush Mishra, Akshayaram Srinivasan, Raluca Ada Popa: Muse: Secure Inference Resilient to Malicious Clients. USENIX Security Symposium 2021: 2201-2218

N-for-1 Auth: N-wise Decentralized Authentication via One Authentication.

Weikeng Chen, Ryan Deng, Raluca Ada Popa: N-for-1 Auth: N-wise Decentralized Authentication via One Authentication. IACR Cryptol. ePrint Arch. 2021: 342 (2021)

NBDT: Neural-Backed Decision Tree.

Alvin Wan, Lisa Dunlap, Daniel Ho, Jihan Yin, Scott Lee, Suzanne Petryk, Sarah Adel Bargal, Joseph E. Gonzalez: NBDT: Neural-Backed Decision Tree. ICLR 2021

New Directions in Cloud Programming.

Alvin Cheung, Natacha Crooks, Joseph M. Hellerstein, Mae Milano: New Directions in Cloud Programming. CoRR abs/2101.01159 (2021)

New Directions in Cloud Programming.

Alvin Cheung, Natacha Crooks, Joseph M. Hellerstein, Mae Milano: New Directions in Cloud Programming. CIDR 2021

ObliCheck: Efficient Verification of Oblivious Algorithms with Unobservable State.

Jeongseok Son, Griffin Prechter, Rishabh Poddar, Raluca Ada Popa, Koushik Sen: ObliCheck: Efficient Verification of Oblivious Algorithms with Unobservable State. USENIX Security Symposium 2021: 2219-2236

Online Learning of Competitive Equilibria in Exchange Economies.

Wenshuo Guo, Kirthevasan Kandasamy, Joseph E. Gonzalez, Michael I. Jordan, Ion Stoica: Online Learning of Competitive Equilibria in Exchange Economies. CoRR abs/2106.06616 (2021)

PAC Best Arm Identification Under a Deadline.

Brijen Thananjeyan, Kirthevasan Kandasamy, Ion Stoica, Michael I. Jordan, Ken Goldberg, Joseph E. Gonzalez: PAC Best Arm Identification Under a Deadline. CoRR abs/2106.03221 (2021)

Pylot: A Modular Platform for Exploring Latency-Accuracy Tradeoffs in Autonomous Vehicles.

Ionel Gog, Sukrit Kalra, Peter Schafhalter, Matthew A. Wright, Joseph E. Gonzalez, Ion Stoica: Pylot: A Modular Platform for Exploring Latency-Accuracy Tradeoffs in Autonomous Vehicles. CoRR abs/2104.07830 (2021)

Pylot: A Modular Platform for Exploring Latency-Accuracy Tradeoffs in Autonomous Vehicles.

Ionel Gog, Sukrit Kalra, Peter Schafhalter, Matthew A. Wright, Joseph E. Gonzalez, Ion Stoica: Pylot: A Modular Platform for Exploring Latency-Accuracy Tradeoffs in Autonomous Vehicles. ICRA 2021: 8806-8813

QFAST: Conflating Search and Numerical Optimization for Scalable Quantum Circuit Synthesis.

Ed Younis, Koushik Sen, Katherine A. Yelick, Costin Iancu: QFAST: Conflating Search and Numerical Optimization for Scalable Quantum Circuit Synthesis. QCE 2021: 232-243

RAMP-TAO: Layering Atomic Transactions on Facebook's Online TAO Data Store.

Audrey Cheng, Xiao Shi, Lu Pan, Anthony Simpson, Neil Wheaton, Shilpa Lawande, Nathan Bronson, Peter Bailis, Natacha Crooks, Ion Stoica: RAMP-TAO: Layering Atomic Transactions on Facebook's Online TAO Data Store. Proc. VLDB Endow. 14(12): 3014-3027 (2021)

Read-Write Quorum Systems Made Practical.

Michael J. Whittaker, Aleksey Charapko, Joseph M. Hellerstein, Heidi Howard, Ion Stoica: Read-Write Quorum Systems Made Practical. CoRR abs/2104.04102 (2021)

Read-Write Quorum Systems Made Practical.

Michael J. Whittaker, Aleksey Charapko, Joseph M. Hellerstein, Heidi Howard, Ion Stoica: Read-Write Quorum Systems Made Practical. PaPoC@EuroSys 2021: 7:1-7:8

Rearchitecting In-Memory Object Stores for Low Latency.

Danyang Zhuo, Kaiyuan Zhang, Zhuohan Li, Siyuan Zhuang, Stephanie Wang, Ang Chen, Ion Stoica: Rearchitecting In-Memory Object Stores for Low Latency. Proc. VLDB Endow. 15(3): 555-568 (2021)

Representing Long-Range Context for Graph Neural Networks with Global Attention.

Zhanghao Wu, Paras Jain, Matthew A. Wright, Azalia Mirhoseini, Joseph E. Gonzalez, Ion Stoica: Representing Long-Range Context for Graph Neural Networks with Global Attention. NeurIPS 2021: 13266-13279

Resource Allocation in Multi-armed Bandit Exploration: Overcoming Sublinear Scaling with Adaptive Parallelism.

Brijen Thananjeyan, Kirthevasan Kandasamy, Ion Stoica, Michael I. Jordan, Ken Goldberg, Joseph Gonzalez: Resource Allocation in Multi-armed Bandit Exploration: Overcoming Sublinear Scaling with Adaptive Parallelism. ICML 2021: 10236-10246

RLlib Flow: Distributed Reinforcement Learning is a Dataflow Problem.

Eric Liang, Zhanghao Wu, Michael Luo, Sven Mika, Joseph E. Gonzalez, Ion Stoica: RLlib Flow: Distributed Reinforcement Learning is a Dataflow Problem. NeurIPS 2021: 5506-5517