Back in Style: A Sociolinguistic Approach to Authoring and Measuring Persona Fidelity in User Simulation
cs.CL
Submitted: 2026-10-07
Updated: 2026-10-07
Terminology
Sources
- Consistently Simulating Human Personas with Multi-Turn Reinforcement Learning
- Can Authorship Attribution Models Distinguish Speakers in Speech Transcripts?
- Eval4Sim: An Evaluation Framework for Persona Simulation
- Simulated Customers Never Walk Away: Decision Fidelity of LLM User Simulators Measured Against Real Purchase Outcomes
- RecUserSim: A Realistic and Diverse User Simulator for Evaluating Conversational Recommender Systems
- Can Multi-Agent LLMs Identify Their Peers? Stylometric Fingerprinting in Role-Constrained Political Analysis
- TwinVoice: A Multi-dimensional Benchmark Towards Digital Twins via LLM Persona Simulation
- Personality Expression Across Contexts: Linguistic and Behavioral Variation in LLM Agents
- Dialect vs Demographics: Quantifying LLM Bias from Implicit Linguistic Signals vs. Explicit User Profiles
- MirrorBench: A Benchmark to Evaluate Conversational User-Proxy Agents for Human-Likeness
- Authorship Attribution in the Era of LLMs: Problems, Methodologies, and Challenges
- LoCar: Localization-Aware Evaluation of In-Vehicle Assistants through Fine-Grained Sociolinguistic Control
- MUSE: Multi-Domain Chinese User Simulation via Self-Evolving Profiles and Rubric-Guided Alignment
- The Assistant Axis: Situating and Stabilizing the Default Persona of Language Models
- Explainable Disentangled Representation Learning for Generalizable Authorship Attribution in the Era of Generative AI
- Quantifying and Optimizing Global Faithfulness in Persona-driven Role-playing
- MM-tau-p$^2$: Persona-Adaptive Prompting for Robust Multi-Modal Agent Evaluation in Dual-Control Settings
- Lost in Simulation: LLM-Simulated Users are Unreliable Proxies for Human Users in Agentic Evaluations
- Role Steering of Language Models for Social Simulations
- CharacterEval: A Chinese Benchmark for Role-Playing Conversational Agent Evaluation
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering