SDARE-Bench: Evaluating Large Language Models on Conversational Stigma Detection and Response in Dyadic and Group Dialogue
cs.CL
Submitted: 2026-09-01
Updated: 2026-09-01
Code: https://github.com/stephaniesyfong/SDARE-Bench
Terminology
Sources
- Phi-4 Technical Report
- Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- DeepSeek-V3 Technical Report
- Mistral 7B
- HateMirage: An Explainable Multi-Dimensional Dataset for Decoding Faux Hate and Subtle Online Abuse
- NVIDIA Nemotron 3: Efficient and Open Intelligence
- Granite Guardian
- Analyzing LLM Reasoning to Uncover Mental Health Stigma
- OpenAI GPT-5 System Card
- Do No Harm: Exposing Hidden Vulnerabilities of LLMs via Persona-based Client Simulation Attack in Psychological Counseling
- Qwen3 Technical Report
- Qwen2.5 Technical Report
- GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models
- ShieldGemma: Generative AI Content Moderation Based on Gemma
- It Hears, It Sees too: Multi-Modal LLM for Depression Detection By Integrating Visual Understanding into Audio Language Models
- Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering