Optimizing watermarks for large language models
cs.CR, cs.AI, cs.CL
Submitted: 2023-12-28
Updated: 2026-09-23
Terminology
Sources
- Watermarking Conditional Text Generation for AI Detection: Unveiling Challenges and a Semantic-Aware Watermark Remedy
- Generative Language Models and Automated Influence Operations: Emerging Threats and Potential Mitigations
- On the Learnability of Watermarks for Language Models
- Unbiased Watermark for Large Language Models
- Evading Watermark based Detection of AI-Generated Content
- Downstream Trade-offs of a Family of Text Watermarks
- A Watermark for Large Language Models
- On the Reliability of Watermarks for Large Language Models
- Paraphrasing evades detectors of AI-generated text, but retrieval is an effective defense
- Undetectable Watermarks for Language Models
- Robust Distortion-free Watermarks for Language Models
- Who Wrote this Code? Watermarking for Code Generation
- Watermarking LLMs with Weight Quantization
- Improving the Generation Quality of Watermarked Large Language Models via Word Importance Scoring
- Can AI-Generated Text be Reliably Detected?
- An Unforgeable Publicly Verifiable Watermark for Large Language Models
- Red Teaming Language Model Detectors with Language Models
- A Semantic Invariant Robust Watermark for Large Language Models
- Baselines for Identifying Watermarked Large Language Models
- WaterBench: Towards Holistic Evaluation of Watermarks for Large Language Models
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs