Revelation Control
cs.LG, cs.AI, stat.ML
Submitted: 2026-08-24
Updated: 2026-08-24
Comments: 38 pages, 4 figures, 6 tables
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- DynaMiCS: Fine-tuning LLMs with Performance Constraints using Dynamic Mixtures
- LoRA: Low-Rank Adaptation of Large Language Models
- Population Based Training of Neural Networks
- Mistral 7B
- Adam: A Method for Stochastic Optimization
- Path-conditioned training: a principled way to rescale ReLU neural networks
- Decoupled Weight Decay Regularization
- Qwen2.5 Technical Report
- Selecting Decision-Relevant Concepts in Reinforcement Learning
- Freeze-Thaw Bayesian Optimization
- Conformal Thinking: Risk Control for Reasoning on a Compute Budget
- Not All Errors Are Equal: Consequence-Aware Reasoning Compute Allocation
- CODA: Difficulty-Aware Compute Allocation for Adaptive Reasoning
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks