PlurVA-LLM-2026 Shared Task Track-1: Pluralistic Value Alignment in LLMs via Multilingual Fine-Tuning and Threshold Calibration
cs.CL
Submitted: 2026-09-26
Updated: 2026-10-08
Terminology
Sources
- MaxMin-RLHF: Alignment with Diverse Human Preferences
- PAL: Pluralistic Alignment Framework for Learning from Heterogeneous Preferences
- Survey on Publicly Available Sinhala Natural Language Processing Tools and Research
- D2VBench: Benchmarking Large Language Models with Value Dilemmas in Daily Scenarios
- Pancasila-Dilemmas: Evaluating Large Language Models on Indonesian Human Value Dilemmas Grounded in Pancasila
- LKValues: Aligning Large Language Models with Sri Lankan Societal Values
- A Roadmap to Pluralistic Alignment
- Diverging Preferences: When do Annotators Disagree and do Models Know?
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering