Task Vector Composition Mitigates Ethical Bias in LLMs
September 21, 2026
A new 12,000-instance dataset explores cross-lingual ethical dilemmas, revealing that GPT-5-mini favors Honesty over Autonomy across five languages. The study demonstrates that task vector composition can decouple dataset correlations from abstract values, helping models navigate conflicting moral preferences.
HOW THIS AFFECTS YOU
●
researcherYou can use task vector composition to more precisely align models with specific ethical frameworks.
●
policyThis research provides tools to quantify and mitigate hidden cultural and moral biases in deployed models.