Cryptography and Security · Computer Science
Strategic Deflection: Defending LLMs from Logit Manipulation
Yassine Rachidy, Jihad Rbaiti, Youssef Hmamouche, Faissal Sehbaoui +1
2025-07-31
Computer Vision and Pattern Recognition · Computer Science
Logit-Attention Divergence: Mitigating Position Bias in Multi-Image Retrieval via Attention-Guided Calibration
Mingtao Xian, Yifeng Yang, Qinying Gu, Xinbing Wang +1
2026-05-13
Computation and Language · Computer Science
Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
Isabel O. Gallegos, Ryan A. Rossi, Joe Barrow, Md Mehrab Tanjim +5
2024-02-06
Artificial Intelligence · Computer Science
Latent State Estimation Helps UI Agents to Reason
William E Bishop, Alice Li, Christopher Rawles, Oriana Riva
2024-05-21
Computation and Language · Computer Science
DEEM: Dynamic Experienced Expert Modeling for Stance Detection
Xiaolong Wang, Yile Wang, Sijie Cheng, Peng Li +1
2024-04-29
Computation and Language · Computer Science
Identifying and Mitigating Social Bias Knowledge in Language Models
Ruizhe Chen, Yichen Li, Jianfei Yang, Joey Tianyi Zhou +2
2025-02-28
Computation and Language · Computer Science
A Multi-LLM Debiasing Framework
Deonna M. Owens, Ryan A. Rossi, Sungchul Kim, Tong Yu +6
2024-09-24
Computation and Language · Computer Science
Thinking Fair and Slow: On the Efficacy of Structured Prompts for Debiasing Language Models
Shaz Furniturewala, Surgan Jandial, Abhinav Java, Pragyan Banerjee +3
2024-05-20
Computer Vision and Pattern Recognition · Computer Science
Logits DeConfusion with CLIP for Few-Shot Learning
Shuo Li, Fang Liu, Zehua Hao, Xinyi Wang +4
2025-04-17
Computation and Language · Computer Science
DeLTa: A Decoding Strategy based on Logit Trajectory Prediction Improves Factuality and Reasoning Ability
Yunzhen He, Yusuke Takase, Yoichi Ishibashi, Hidetoshi Shimodaira
2025-03-05
Computation and Language · Computer Science
Bridging the Gap: Dynamic Learning Strategies for Improving Multilingual Performance in LLMs
Somnath Kumar, Vaibhav Balloli, Mercy Ranjit, Kabir Ahuja +4
2025-01-08
Computation and Language · Computer Science
Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs
Mengdan Zhu, Senhao Cheng, Liang Zhao
2026-04-10
Computation and Language · Computer Science
LF-Steering: Latent Feature Activation Steering for Enhancing Semantic Consistency in Large Language Models
Jingyuan Yang, Rongjun Li, Weixuan Wang, Ziyu Zhou +2
2025-01-23
Computation and Language · Computer Science
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
Schrasing Tong, Eliott Zemour, Jessica Lu, Rawisara Lohanimit +1
2026-03-09
Computation and Language · Computer Science
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
Ruizhe Chen, Yichen Li, Zikai Xiao, Zuozhu Liu
2024-07-02
Cryptography and Security · Computer Science
Uncovering Logit Suppression Vulnerabilities in LLM Safety Alignment
Yuxi Li, Yi Liu, Yuekang Li, Ling Shi +3
2026-04-21
Computation and Language · Computer Science
CogSteer: Cognition-Inspired Selective Layer Intervention for Efficiently Steering Large Language Models
Xintong Wang, Jingheng Pan, Liang Ding, Longyue Wang +3
2025-06-03
Computation and Language · Computer Science
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
Yuchun Fan, Yongyu Mu, Yilin Wang, Lei Huang +6
2025-01-08