ProgressCompass: Embodied Progress Reward Models Are Lost Without the Right Context
cs.CL
Submitted: 2026-09-29
Updated: 2026-09-29
Project page: https://andyzworks.github.io/progresscompass
Terminology
Sources
- TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics
- RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies
- RMBench: Memory-Dependent Robotic Manipulation Benchmark with Insights into Policy Design
- Hide-and-Seek in Trajectories: Discovering Failure Signals for VLA Runtime Monitoring
- WebAggregator: Enhancing Compositional Reasoning Capabilities of Deep Research Agent Foundation Models
- Learning Agent-Compatible Context Management for Long-Horizon Tasks
- Progress Reward Modeling for Robotic Learning: A Comprehensive Survey
- Memory as Action: Autonomous Context Curation for Long-Horizon Agentic Tasks
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering