Computation and Language · Computer Science
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
Schrasing Tong, Eliott Zemour, Jessica Lu, Rawisara Lohanimit +1
2026-03-09
Machine Learning · Computer Science
A Comprehensive Study of Implicit and Explicit Biases in Large Language Models
Fatima Kazi, Alex Young, Yash Inani, Setareh Rafatirad
2025-11-19
Computation and Language · Computer Science
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
Yujie Lin, Kunquan Li, Yixuan Liao, Xiaoxin Chen +1
2026-02-05
Computation and Language · Computer Science
Investigating Implicit Bias in Large Language Models: A Large-Scale Study of Over 50 LLMs
Divyanshu Kumar, Umang Jain, Sahil Agarwal, Prashanth Harshangi
2024-10-18
Computation and Language · Computer Science
Improving Bias Mitigation through Bias Experts in Natural Language Understanding
Eojin Jeon, Mingyu Lee, Juhyeong Park, Yeachan Kim +2
2023-12-07
Computation and Language · Computer Science
Large, Small or Both: A Novel Data Augmentation Framework Based on Language Models for Debiasing Opinion Summarization
Yanyue Zhang, Pengfei Li, Yilong Lai, Deyu Zhou +1
2025-03-04
Computation and Language · Computer Science
Reducing Gender Bias in Word-Level Language Models with a Gender-Equalizing Loss Function
Yusu Qian, Urwa Muaz, Ben Zhang, Jae Won Hyun
2019-06-05
Computation and Language · Computer Science
Challenges in Annotating Datasets to Quantify Bias in Under-represented Society
Vithya Yogarajan, Gillian Dobbie, Timothy Pistotti, Joshua Bensemann +1
2023-09-19
Computation and Language · Computer Science
A Multi-LLM Debiasing Framework
Deonna M. Owens, Ryan A. Rossi, Sungchul Kim, Tong Yu +6
2024-09-24
Computation and Language · Computer Science
Decoding Biases: Automated Methods and LLM Judges for Gender Bias Detection in Language Models
Shachi H Kumar, Saurav Sahay, Sahisnu Mazumder, Eda Okur +5
2024-08-08
Computation and Language · Computer Science
Self-Debias: Self-correcting for Debiasing Large Language Models
Xuan Feng, Shuai Zhao, Luwei Xiao, Tianlong Gu +1
2026-05-12
Computation and Language · Computer Science
Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
Isabel O. Gallegos, Ryan A. Rossi, Joe Barrow, Md Mehrab Tanjim +5
2024-02-06
Computation and Language · Computer Science
Large Language Models Are Still Misled by Simple Bias Ensembles
Zhouhao Sun, Zhiyuan Kan, Xiao Ding, Li Du +4
2026-04-21
Computation and Language · Computer Science
Pride and Prejudice: LLM Amplifies Self-Bias in Self-Refinement
Wenda Xu, Guanglei Zhu, Xuandong Zhao, Liangming Pan +2
2024-06-19
Computation and Language · Computer Science
Bias in Large Language Models: Origin, Evaluation, and Mitigation
Yufei Guo, Muzhe Guo, Juntao Su, Zhou Yang +4
2026-05-04
Computation and Language · Computer Science
Investigating the Capabilities and Limitations of Machine Learning for Identifying Bias in English Language Data with Information and Heritage Professionals
Lucy Havens, Benjamin Bach, Melissa Terras, Beatrice Alex
2025-04-02
Computation and Language · Computer Science
Do the Right Thing, Just Debias! Multi-Category Bias Mitigation Using LLMs
Amartya Roy, Danush Khanna, Devanshu Mahapatra, Vasanthakumar +2
2024-09-26