ScribbleEdit: A Benchmark for Scribble-Only Image Editing
cs.GR, cs.CV
Submitted: 2026-10-07
Updated: 2026-10-07
Code: https://github.com/black-forest-labs/flux
Terminology
Sources
- Qwen2.5-VL Technical Report
- DiffEdit: Diffusion-based semantic image editing with mask guidance
- Emerging Properties in Unified Multimodal Pretraining
- Personalize Anything for Free with Diffusion Transformer
- Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Draw-and-Understand: Leveraging Visual Prompts to Enable MLLMs to Comprehend What You Want
- Step1X-Edit: A Practical Framework for General Image Editing
- SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations
- DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models
- DreamO: A Unified Framework for Image Customization
- EdgeConnect: Generative Image Inpainting with Adversarial Edge Learning
- Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks
- OmniGen2: Towards Instruction-Aligned Multimodal Generation
- Faster Segment Anything: Towards Lightweight SAM for Mobile Applications
- V2P-Bench: Evaluating Video-Language Understanding with Visual Prompts for Better Human-Model Interaction
Related papers
- SCRIPT: Scalable Diffusion Policy with Multi-stage Training for Language-driven Physics-Based Humanoid Control
- CADReasoner: Iterative Program Editing for CAD Reverse Engineering
- QuadLink: Autoregressive Quad-Dominant Mesh Generation via Point-Relation Learning
- DrawVideo: Grounded and Faithful Multi-Shot Video Generation from Storyboard Keyframe Sketches
- MotionPersona: Real-Time Locomotion Control across Personas, Bodies, and Styles
- MeshSplatBench: A Unified Benchmark for Triangle- and Mesh-Based Neural Rendering