ForgeDAN: An Evolutionary Framework for Jailbreaking Aligned Large Language Models
cs.CR, cs.AI, cs.CL
Submitted: 2025-11-17
Updated: 2025-11-17
Terminology
Sources
- Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study
- Don't Say No: Jailbreaking LLM by Suppressing Refusal
- Automated Progressive Red Teaming
- Safety Assessment of Chinese Large Language Models
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs