Watermarking Should Be Treated as a Monitoring Primitive
cs.CR, cs.AI, cs.CY, cs.LG
Submitted: 2026-05-13
Updated: 2026-09-26
Terminology
Sources
- GPT-4 Technical Report
- Hidden in the Noise: Two-Stage Robust Watermarking for Images
- Mitigating Watermark Forgery in Generative Models via Randomized Key Selection
- Adaptively Robust LLM Monitoring via Activation Watermarking
- Provably Robust Watermarks for Open-Source Language Models
- BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding
- Optimizing Adaptive Attacks against Watermarks for Language Models
- Discovering Spoofing Attempts on Language Model Watermarks
- An Undetectable Watermark for Generative Image Models
- SemStamp: A Semantic Watermark with Paraphrastic Robustness for Text Generation
- On the Reliability of Watermarks for Large Language Models
- Stylometric Detection of AI-Generated Text in Twitter Timelines
- A Survey of AI-generated Text Forensic Systems: Detection, Attribution, and Characterization
- Position: LLM Watermarking Should Align Stakeholders' Incentives for Practical Adoption
- MarkLLM: An Open-Source Toolkit for LLM Watermarking
- MarkDiffusion: An Open-Source Toolkit for Generative Watermarking of Latent Diffusion Models
- Mark My Words: Analyzing and Evaluating Language Model Watermarks
- Large Language Model Watermark Stealing With Mixed Integer Programming
- SoK: Watermarking for AI-Generated Content
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs