Disappearing Ink: Obfuscation Breaks N-gram Code Watermarks in Theory and Practice
cs.CR, cs.AI
Submitted: 2025-07-07
Updated: 2026-08-30
Code: https://github.com/mishoo/UglifyJS
Terminology
Sources
- Evaluating Large Language Models Trained on Code
- DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence
- GPT-4o System Card
- RankGen: Improving Text Generation with Large Ranking Models
- Adaptive Text Watermark for Large Language Models
- MCGMark: An Encodable and Robust Online Watermark for Tracing LLM-Generated Malicious Code
- Can AI-Generated Text be Reliably Detected?
- LLaMA: Open and Efficient Foundation Language Models
- SoK: Watermarking for AI-Generated Content
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs