Modality Fault Lines: Structural Corruptions Reveal Fragile Omni-Modal Reasoning
cs.CL
Submitted: 2026-08-29
Updated: 2026-10-04
Comments: EMNLP 2026 Findings
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- Seeing Across Views: Benchmarking Spatial Reasoning of Vision-Language Models in Robotic Scenes
- How Order-Sensitive Are LLMs? OrderProbe for Deterministic Structural Reconstruction
- Benchmarking Neural Network Robustness to Common Corruptions and Perturbations
- GPT-4o System Card
- QuantEval: A Benchmark for Financial Quantitative Tasks in Large Language Models
- Baichuan-Omni Technical Report
- Ola: Pushing the Frontiers of Omni-Modal Language Model
- Benchmarking Robustness of Multimodal Image-Text Models under Distribution Shift
- SPADER: Step-wise Peer Advantage with Diversity-Aware Exploration Rewards for Multi-Answer Question Answering
- Gemini: A Family of Highly Capable Multimodal Models
- Qwen3.5-Omni Technical Report
- OmniVinci: Enhancing Architecture and Data for Omni-Modal Understanding LLM
- Benchmarking Large Multimodal Models against Common Corruptions
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering