EAGER: Enhancing Generative Event Extraction via Reinforcement Learning with Verifiable Rewards
cs.CL
Submitted: 2026-09-24
Updated: 2026-09-24
Code: https://github.com/huggingface/trl
Terminology
Sources
- SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training
- EventRL: Enhancing Event Extraction with Outcome Supervision for Large Language Models
- Exploring the Feasibility of ChatGPT for Event Extraction
- The Llama 3 Herd of Models
- DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
- Does Math Reasoning Improve General LLM Capabilities? Understanding Transferability of LLM Reasoning
- GPT-4o System Card
- GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
- OpenAI o1 System Card
- PIVOINE: Instruction Tuning for Open-world Information Extraction
- Cross-media Structured Common Space for Multimedia Event Extraction
- Code Llama: Open Foundation Models for Code
- Proximal Policy Optimization Algorithms
- OpenAI GPT-5 System Card
- InstructUIE: Multi-task Instruction Tuning for Unified Information Extraction
- Scaf-GRPO: Scaffolded Group Relative Policy Optimization for Enhancing LLM Reasoning
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering