Toward Stronger Code Watermarking: A Grammar-Driven Approach to Optimizing the Trade-off Between Quality and Detectability
Licheng Yu, Aiwei Liu, Songze Li
cs.CR, cs.CL
Submitted: 2026-07-11
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- Evaluating Large Language Models Trained on Code
- BiMark: Unbiased Multilayer Watermarking for Large Language Models
- Qwen2.5-Coder Technical Report
- StarCoder 2 and The Stack v2: The Next Generation
- Token-Specific Watermarking with Enhanced Detectability and Semantic Coherence for Large Language Models
- An Entropy-based Text Watermarking Detection Method
- Marking Code Without Breaking It: Code Watermarking for Detecting LLM-Generated Code
- Watermarking Low-entropy Generation for Large Language Models: An Unbiased and Low-risk Method
- On the Reliability of Watermarks for Large Language Models
- OctoPack: Instruction Tuning Code Large Language Models
- Embarrassingly Simple Text Watermarks
- Turning Your Strength into Watermark: Watermarking Large Language Model via Knowledge Injection
- Is The Watermarking Of LLM-Generated Code Robust?
- Necessary and Sufficient Watermark for Large Language Models
- Towards Codable Watermarking for Injecting Multi-bits Information to LLMs
- Qwen3 Technical Report
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs