Here is a GIFT: Enforcing User Data Isolation in LLM Serving via GPU Information Flow Tracking
cs.CR
Submitted: 2026-08-26
Updated: 2026-08-26
Code: https://github.com/onnx/onnx
Terminology
Sources
- Evaluating Large Language Models Trained on Code
- PhoenixOS: Concurrent OS-level GPU Checkpoint and Restore with Validated Speculation
- LLaMA: Open and Efficient Foundation Language Models
- Characterizing Network Requirements for GPU API Remoting in AI Applications
- SGLang: Efficient Execution of Structured Language Model Programs
- Qwen2.5 Technical Report
- OPT: Open Pre-trained Transformer Language Models
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs