Leaky Students: Membership Inference against On-Policy Distillation
cs.LG, cs.CR
Submitted: 2026-09-27
Updated: 2026-09-27
Terminology
Sources
- Window-based Membership Inference Attacks Against Fine-tuned Large Language Models
- DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
- Gemma 4 Technical Report
- Distilling the Knowledge in a Neural Network
- DP-OPD: Differentially Private On-Policy Distillation for Language Models
- Tulu 3: Pushing Frontiers in Open Language Model Post-Training
- TACO: Topics in Algorithmic COde generation dataset
- ReNIO: Reweighting Negative Trajectory Importance for LLM On-Policy Distillation
- Auditing Data Membership in Reinforcement Learning With Verifiable Rewards
- Privileged Information Distillation for Language Models
- Self-Distillation Enables Continual Learning
- (Token-Level) InfoRMIA: Stronger Membership Inference and Memorization Assessment for LLMs
- On the Importance of Difficulty Calibration in Membership Inference Attacks
- Qwen3 Technical Report
- On-Policy Context Distillation for Language Models
- Opacus: User-Friendly Differential Privacy Library in PyTorch
- Differentially Private Fine-tuning of Language Models
- Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks