Large Language Models as Falsifiers for Cyber-Physical Systems
eess.SY, cs.AI, cs.LO, cs.SE, cs.SY
Submitted: 2026-09-17
Updated: 2026-09-17
Comments: 22 pages, 5 figures, 3 tables
Code: https://github.com/aliabigdeli/llm-falsifier
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- gpt-oss-120b & gpt-oss-20b Model Card
- In-context Reinforcement Learning with Algorithm Distillation
- LLMs Are In-Context Bandit Reinforcement Learners
- Can Language Models Falsify? Evaluating Algorithmic Reasoning with Counterexample Creation
Related papers
- One Request, Multiple Experts: LLM Orchestrates Domain Specific Models via Adaptive Task Routing
- A Geometric Decision Procedure for STL Feasibility and Repair
- Submodular Multi-Agent Policy Learning for Online Distributed Task Allocation in Open Multi-Agent Systems
- Policy-Level Recursive Self-Improvement for Embodied AI with a Criticality World Model
- Minimal Experiments for Robust Stabilization: Information, Spectral Geometry, and Duration
- Decentralized Power-Optimal Coordination for Spacecraft Swarms Using Time-Varying Magnetorquer Actuation