Maat: Independent Deterministic Contract-Based Governance for Multi-Agent LLM Workflows
cs.SE, cs.AI, cs.MA
Submitted: 2026-09-27
Updated: 2026-09-27
Code: https://github.com/Lorelys/maat-benchmarks
Project page: https://maat.synwe.ai
Terminology
Sources
- Why Do Multi-Agent LLM Systems Fail?
- Delayed Verification Destabilizes Multi-Agent LLM Belief: Instability Thresholds and Optimal Corrector Placement
- Hallucination Cascade: Analyzing Error Propagation in Multi-Agent LLM Systems
- Towards a Science of Scaling Agent Systems
- Aegis: Automated Error Generation and Attribution for Multi-Agent Systems
- MASPrism: Lightweight Failure Attribution for Multi-Agent Systems Using Prefill-Stage Signals
- Explainable and Fine-Grained Safeguarding of LLM Multi-Agent Systems via Bi-Level Graph Anomaly Detection
- Detecting Silent Failures in Multi-Agentic AI Trajectories
- VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems
- AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security
- From Spark to Fire: Modeling and Mitigating Error Cascades in LLM-Based Multi-Agent Collaboration
- PropGuard: Safeguarding LLM-MAS via Propagation-Aware Exploration and Remediation
- Agent-as-a-Judge
- Agora: Git as Shared Memory for Collective AutoResearch
- Agent-as-a-Judge: Evaluate Agents with Agents
Related papers
- Falsification-Based Verification of LLM-Generated Optimization Models: Sound Test Batteries and Their Detection Limits
- GitSkills: A Dataset of Agent Skills on GitHub
- SABER: Benchmarking Operational Safety of LLM Coding Agents in Stateful Project Workspaces
- PackMonitor: Enabling Zero Package Hallucinations Through Decoding-Time Monitoring
- IntentCoding: Amplifying User Intent in Code Generation
- Incentives and Outcomes in Bug Bounties