How Reproducible Are Evaluation Conclusions? A Self-Audit of LLM-Inferred Prompt Structure

arXiv:2609.30074 · cs.CL, cs.AI, cs.LG · Submitted 2026-09-24 · Read on arXiv

cs.CL, cs.AI, cs.LG

Submitted: 2026-09-24

Updated: 2026-09-24

Terminology

Sources

Related papers