CineForge: Self-Improving Agents for Long-Horizon Video Generation
cs.CV, cs.AI
Submitted: 2026-08-30
Updated: 2026-08-30
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- DemoEvolve: Overcoming Sparse Feedback in Agentic Harness Evolution with Demonstrations
- DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation
- From Failed Trajectories to Reliable LLM Agents: Diagnosing and Repairing Harness Flaws
- TaleCrafter: Interactive Story Visualization with Multiple Characters
- MAPGD: Multi-Agent Prompt Gradient Descent for Collaborative Prompt Optimization
- EntityBench: Towards Entity-Consistent Long-Range Multi-Shot Video Generation
- Automated Design of Agentic Systems
- GenMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration
- ViMax: Agentic Video Generation
- VBench: Comprehensive Benchmark Suite for Video Generative Models
- VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
- DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines
- AgentX: Towards Agent-Driven Self-Iteration of Industrial Recommender Systems
- StoryGAN: A Sequential Conditional GAN for Story Visualization
- VideoDirectorGPT: Consistent Multi-scene Video Generation via LLM-Guided Planning
- Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses
- Harness Updating Is Not Harness Benefit: Disentangling Evolution Capabilities in Self-Evolving LLM Agents
- Advancing Narrative Long Video Generation via Training-Free Identity-Aware Memory
- LongAV-Compass: Towards Unified Evaluation of Minute-Scale Audio-Visual Generation Across T2AV, I2AV, and V2AV
- VISTA: A Test-Time Self-Improving Video Generation Agent
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models