Pay for the Fault, Not the Flow: Label-Free In-Flow Multi-Agent Workflow Optimization
cs.AI, cs.CL
Submitted: 2026-10-01
Updated: 2026-10-02
Project page: https://xhguo7.github.io/InFlowOp
Terminology
Sources
- Web-Shepherd: Advancing PRMs for Reinforcing Web Agents
- AppWorld-UL: Benchmarking Diverse Agent-User Interactions for Tool-Use
- Seeing the Whole Elephant: A Benchmark for Failure Attribution in LLM-based Multi-Agent Systems
- Debate or Vote: Which Yields Better Decisions in Multi-Agent Large Language Models?
- Uno-Orchestra: Parsimonious Agent Routing via Selective Delegation
- Multi-Agent Collaboration via Evolving Orchestration
- LongDocURL: a Comprehensive Multimodal Long Document Benchmark Integrating Understanding, Reasoning, and Locating
- HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
- SwarmBench: Can Large Language Models Act as Agent Swarm Orchestrators?
- Anagent For Enhancing Scientific Table & Figure Analysis
- FaSTA$^*$: Fast-Slow Toolpath Agent with Subroutine Mining for Efficient Multi-turn Image Editing
- Measuring Mathematical Problem Solving With the MATH Dataset
- Who is the Agent to Blame? Localizing Faithfulness and Citation Mistakes in Agentic Deep Research
- MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework
- EDGE: Error Dependency Graph-Guided Multi-Error Attribution in Multi-Agent LLM Systems
- Agentic Monte Carlo: Simulating Reinforcement Learning for Black-Box Agents
- The Illusion of Multi-Agent Advantage
- PRInTS: Reward Modeling for Long-Horizon Information Seeking
- Agentic Aggregation for Parallel Scaling of Long-Horizon Agentic Tasks
Related papers
- MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Prediction
- Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models
- The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing
- MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention
- Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems
- VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection