Modelpedia
Work in progress
About
Findings
Models
Concepts
Methods
Datasets
Sources
Light
Dark
Bias Runs Deep: Implicit Reasoning Biases in Persona-Assigned LLMs
2024-01-16
· ICLR 2024 poster ·
anchor
Findings
IC-1342
Assigning socio-demographic personas to LLMs causes significant reasoning performance degradation across all four models studied, manifesting as both explicit abstentions and implicit reasoning errors
IC-1343
Task-agnostic de-biasing prompts are ineffective at reducing persona-induced reasoning bias in ChatGPT-3.5, while task-dependent expertise prompts are effective but lack generalizability