Can LLMs Time Travel? Enhancing Temporal Consistency in Legal Agentic Search through Reinforcement Learning
cs.CL, cs.AI
Submitted: 2026-05-25
Updated: 2026-09-19
Comments: Accepted by EMNLP NLLP 2026
Code: https://github.com/AlexFanw/LegalSearch-R1
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- GPT-4 Technical Report
- SaulLM-7B: A pioneering Large Language Model for Law
- Open Deep Search: Democratizing Search with Open-source Reasoning Agents
- Unilaw-R1: A Large Language Model for Legal Reasoning with Reinforcement Learning and Iterative Inference
- ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
- Chatlaw: A Multi-Agent Legal Assistant based on a Role-Aligned Mixture-of-Experts Architecture
- Legal$\Delta$: Enhancing Legal Reasoning in LLMs via Reinforcement Learning with Chain-of-Thought Guided Information Gain
- DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
- DeepSeek-V3 Technical Report
- DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping
- LawBench: Benchmarking Legal Knowledge of Large Language Models
- Retrieval-Augmented Generation for Large Language Models: A Survey
- LegalBench: A Collaboratively Built Benchmark for Measuring Legal Reasoning in Large Language Models
- Lawyer LLaMA Technical Report
- Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
- Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks
- LRAGE: Legal Retrieval Augmented Generation Evaluation Tool
- OpenAI o1 System Card
- Qwen2.5 Technical Report
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering