Typed Decision Models: An Early Evidence Audit and Evaluation Checklist
cs.CL, cs.AI, cs.LG
Submitted: 2026-09-26
Updated: 2026-09-26
Code: https://github.com/youzizzz1028/Awesome-Jev
Terminology
Sources
- Harness Tokenomics: A Router for the Enterprise Agentic Control Plane
- Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation
- this-that-model-1.0: A typed decision model that decides in 30 ms, for a millionth of a cent
- Universal Fractal Natural Language Decision Map: Real-Time Edge Triage Across Heterogeneous Domains
- Jev for Scientific Decisions: Evaluating Semantic Choices and Their Consequences
- Calibrated Decision Models for Autonomous Penetration-Testing Harnesses: JEV and Laya as System One Decision Layers for LLM-Driven Pentest Agents
- Just Ask Jev: Reinforcement Learning for Calibrated Decisions as a Zero-Shot Detector of AI Alignment Failures
- Can Jev Judge Radiology Reports? Evaluating a System One Model for Clinical Factuality
- Evaluating Decision Models for Text Annotation in Computational Social Science
- Jev-Mem: System-One-Controlled Agentic Memory for Efficient AI Agents
- Language Models (Mostly) Know What They Know
- Building Efficient Universal Classifiers with Natural Language Inference
- JEV-as-a-Judge: Accept When Confident, Escalate When Unsure
- Calibrated Decisions at Scale: Converting Police Crash Narratives into Probabilistic Crash Variables with a System One Model (Jev)
- JEV vs. LLMs as Rubric Judges: Cheaper, Faster, and Wrong in the Same Places
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering