Same Bytes, Different Authority: Reserved-Token Representations in Chat-Template Prompt Injection
cs.CR, cs.AI, cs.LG
Submitted: 2026-09-28
Updated: 2026-09-28
Terminology
Sources
- Meta-SecAlign: Training LLMs against Prompt Injection for Robust Agents
- Automating Agent Hijacking via Structural Template Injection
- Separator Injection Attack: Uncovering Dialogue Biases in Large Language Models Caused by Role Separators
- TokenBreak: Bypassing Text Classification Models Through Token Manipulation
- The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs