KidnapRAG: A Black-Box Attack for Hijacking Reasoning in Agentic Retrieval-Augmented Generation Systems
cs.CR
Submitted: 2026-07-01
Updated: 2026-08-28
Comments: Accepted to the Main Conference of EMNLP 2026
Code: https://github.com/chanwoochoi316/KidnapRAG
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- Ignore Previous Prompt: Attack Techniques For Language Models
- Chain-of-Trigger: An Agentic Backdoor that Paradoxically Enhances Agentic Robustness
- The Llama 3 Herd of Models
- DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
- Text Embeddings by Weakly-Supervised Contrastive Pre-training
- Step Potential Advantage Estimation: Harnessing Intermediate Confidence and Correctness for Efficient Mathematical Reasoning
- Qwen3 Technical Report
- Qwen2.5 Technical Report
- ReAct: Synergizing Reasoning and Acting in Language Models
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs