Circuit-MLLM: Topological Logic-Guided Latent-Space Visual Reasoning for Circuit Schematic Understanding
cs.CV, cs.AI, cs.LG
Submitted: 2026-09-14
Updated: 2026-09-14
Comments: Accepted at European Conference on Computer Vision (ECCV) 2026
Code: https://github.com/IC-Yuan/Circuit-MLLM
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- Masala-CHAI: A Large-Scale SPICE Netlist Dataset for Analog Circuits by Harnessing AI
- PaddleOCR-VL: Boosting Multilingual Document Parsing via a 0.9B Ultra-Compact Vision-Language Model
- Interleaved Latent Visual Reasoning with Selective Perceptual Modeling
- AnalogGenie: A Generative Engine for Automatic Discovery of Analog Circuit Topologies
- Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
- Latent Visual Reasoning
- AMSnet 2.0: A Large AMS Database with AI Segmentation for Net Detection
- AMSbench: A Comprehensive Benchmark for Evaluating MLLM Capabilities in AMS Circuits
- SeePhys: Does Seeing Help Thinking? -- Benchmarking Vision-Based Physics Reasoning
- Machine Mental Imagery: Empower Multimodal Reasoning with Latent Visual Tokens
- Multimodal Chain-of-Thought Reasoning in Language Models
- MAPS: Advancing Multi-Modal Reasoning in Expert-Level Physical Science
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models