PainterBench: A Figural Divergent-Thinking Benchmark for Tool-Using Language Models
cs.AI, cs.CL, cs.HC
Submitted: 2026-09-28
Updated: 2026-09-28
Code: https://github.com/deepseek-ai/Thinking-with-Visual-Primitives
Terminology
Sources
- Sparks of Artificial General Intelligence: Early experiments with GPT-4
- Leveraging Large Language Models for Scalable Vector Graphics-Driven Image Understanding
- Within-Model vs Between-Prompt Variability in Large Language Models for Creative Tasks
- DrawingBench: Evaluating Spatial Reasoning and UI Interaction Capabilities of Large Language Models through Mouse-Based Drawing Tasks
- UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction
- Pencils to Pixels: A Systematic Study of Creative Drawings across Children, Adults and AI
- CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing
- CreativityNeuro: Steering Language Model Weights to Improve Divergent Thinking and Reduce Mode Collapse
- LLMs have Visualization Literacy: Now What? Experiments Exploring LLM Visualization Evaluation Capabilities
- Putting GPT-3's Creativity to the (Alternative Uses) Test
- 3DrawAgent: Teaching LLM to Draw in 3D with Early Contrastive Experience
Related papers
- MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Prediction
- Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models
- The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing
- MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention
- Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems
- VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection