Forging LLM Authorship Fingerprints with Targeted Rewriting
cs.CL
Submitted: 2026-09-30
Updated: 2026-09-30
Code: https://github.com/HaohanYuan01/ForgePrint
Terminology
Sources
- Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs
- Construction-Driven Injection: Linguistically-Grounded Edit-Based Code-Mixing Fingerprints for Large Language Models
- AuthorMist: Evading AI Text Detectors with Reinforcement Learning
- TRACE: A Two-Channel Robust Attribution Watermark via Complementary Embeddings for LLM-Agent Trajectories
- WikiHow: A Large Scale Text Summarization Dataset
- RoBERTa: A Robustly Optimized BERT Pretraining Approach
- The Assistant Erased You: Measuring Loss of Authorship Signals in AI-Mediated Communication
- ARB: A Matched Authorship-Rewriting Benchmark Dataset for AI-Text Detector Evaluation
- Direct Preference Optimization: Your Language Model is Secretly a Reward Model
- Can AI-Generated Text be Reliably Detected?
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
- Targeted Counterfactual Fingerprinting for Black-Box LLM Ownership Verification
- Assessing Deanonymization Risks with Stylometry-Assisted LLM Agent
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering