Marathoner: Ultra-Long-Horizon Autonomous Intelligence
cs.CV
Submitted: 2026-09-28
Updated: 2026-09-28
Terminology
Sources
- GPT-4 Technical Report
- SWE-Marathon: Can Agents Autonomously Complete Ultra-Long-Horizon Software Work?
- NL2Repo-Bench: Towards Long-Horizon Repository Generation Evaluation of Coding Agents
- A Survey on Code Generation with LLM-based Agents
- Process Reward Models That Think
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
- OpenAI GPT-5 System Card
- Kimi K3: Open Frontier Intelligence
- AI Agentic Programming: A Survey of Techniques, Challenges, and Opportunities
- Why Reasoning Fails to Plan: A Planning-Centric Analysis of Long-Horizon Decision Making in LLM Agents
- ReAct: Synergizing Reasoning and Acting in Language Models
- A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models