TYPO: Instruction-Dense Visual Jailbreaks against Commercial Closed-Source Image-Generation Models
Meng Xie, Li Zeng, Hangtao Zhang, Xianlong Wang, Ziqi Zhou, Pengpeng Qiao, Zhetao Li
cs.CR
Submitted: 2026-07-27
Code: https://github.com/Heart-Meng/TYPO
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- Jailbreaking Black Box Large Language Models in Twenty Queries
- Dynamic Optimization and Safety Indicator Injection for Jailbreaking Text-to-Image Models with Multimodal Safety Filters
- Harnessing LLM to Attack LLM-Guarded Text-to-Image Models
- Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations
- H-CoT: Hijacking the Chain-of-Thought Safety Reasoning Mechanism to Jailbreak Large Reasoning Models, Including OpenAI o1/o3, DeepSeek-R1, and Gemini 2.0 Flash Thinking
- AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs
- Tree of Attacks: Jailbreaking Black-Box LLMs Automatically
- Hierarchical Text-Conditional Image Generation with CLIP Latents
- Red-Teaming the Stable Diffusion Safety Filter
- Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding
- AnyText2: Visual Text Generation and Editing With Customizable Attributes
- Robot Collapse: Supply Chain Backdoor Attacks Against VLM-based Robotic Manipulation
- DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence
- Text to Image Generation and Editing: A Survey
- GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts
- Reason2Attack: Jailbreaking Text-to-Image Models via LLM Reasoning
- Qwen-Image-2.0 Technical Report
- When Memory Becomes a Vulnerability: Towards Multi-turn Jailbreak Attacks against Text-to-Image Generation Systems
- Universal and Transferable Adversarial Attacks on Aligned Language Models
Related papers
- SoK: AI-Augmented Binary Reversing
- Relaxed Sender Anonymity for CBDC Interbank Settlement: A Zero-Knowledge Approach on Permissioned EVM
- Calibration-Family Overfit: Why Trusted Sabotage Monitors Don't Transfer Across Lineages
- Efficient Fuzzy PSI under One-Sided Assumptions
- Sealing the Audit-Runtime Gap for LLM Skills
- Token Composition: A Graph Based on EVM Logs