AffectReveal: Event-Grounded Emotion Recognition Beyond Visual Appearances
cs.CV
Submitted: 2026-09-29
Updated: 2026-09-29
Terminology
Sources
- BlazeFace: Sub-millisecond Neural Face Detection on Mobile GPUs
- PaddleOCR 3.0 Technical Report
- AffectGPT: A New Dataset, Model, and Benchmark for Emotion Understanding with Multimodal Large Language Models
- Emotion-LLaMAv2 and MMEVerse: A New Framework and Benchmark for Multimodal Emotion Understanding
- Qwen3.5-Omni Technical Report
- AffectAgent: Collaborative Multi-Agent Reasoning for Retrieval-Augmented Multimodal Emotion Recognition
- ReAct: Synergizing Reasoning and Acting in Language Models
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models