Cryptography and Security · Computer Science
Machine Learning Security against Data Poisoning: Are We There Yet?
Antonio Emanuele Cinà, Kathrin Grosse, Ambra Demontis, Battista Biggio +2
2024-03-11
Cryptography and Security · Computer Science
Multi-Faceted Studies on Data Poisoning can Advance LLM Development
Pengfei He, Yue Xing, Han Xu, Zhen Xiang +1
2025-02-21
Machine Learning · Computer Science
Learning to Poison Large Language Models for Downstream Manipulation
Xiangyu Zhou, Yao Qiang, Saleh Zare Zade, Mohammad Amin Roshani +3
2025-05-30
Cryptography and Security · Computer Science
Scaling Trends for Data Poisoning in LLMs
Dillon Bowen, Brendan Murphy, Will Cai, David Khachaturov +2
2025-07-18
Cryptography and Security · Computer Science
From Poisoned to Aware: Fostering Backdoor Self-Awareness in LLMs
Guangyu Shen, Siyuan Cheng, Xiangzhe Xu, Yuan Zhou +3
2025-10-08
Cryptography and Security · Computer Science
Enhancing Prompt Injection Attacks to LLMs via Poisoning Alignment
Zedian Shao, Hongbin Liu, Jaden Mu, Neil Zhenqiang Gong
2025-09-16
Cryptography and Security · Computer Science
Forcing Generative Models to Degenerate Ones: The Power of Data Poisoning Attacks
Shuli Jiang, Swanand Ravindra Kadhe, Yi Zhou, Ling Cai +1
2023-12-11
Computation and Language · Computer Science
Revisiting Backdoor Attacks on LLMs: A Stealthy and Practical Poisoning Framework via Harmless Inputs
Jiawei Kong, Hao Fang, Xiaochen Yang, Kuofeng Gao +4
2025-10-07
Computation and Language · Computer Science
Poisoning Language Models During Instruction Tuning
Alexander Wan, Eric Wallace, Sheng Shen, Dan Klein
2023-05-02
Cryptography and Security · Computer Science
A Systematic Review of Poisoning Attacks Against Large Language Models
Neil Fendley, Edward W. Staley, Joshua Carney, William Redman +2
2025-06-10
Machine Learning · Computer Science
Are My Optimized Prompts Compromised? Exploring Vulnerabilities of LLM-based Optimizers
Andrew Zhao, Reshmi Ghosh, Vitor Carvalho, Emily Lawton +3
2026-01-14
Software Engineering · Computer Science
Measuring Impacts of Poisoning on Model Parameters and Neuron Activations: A Case Study of Poisoning CodeBERT
Aftab Hussain, Md Rafiqul Islam Rabin, Navid Ayoobi, Mohammad Amin Alipour
2024-03-06
Machine Learning · Computer Science
Poisoning Attacks on LLMs Require a Near-constant Number of Poison Samples
Alexandra Souly, Javier Rando, Ed Chapman, Xander Davies +9
2025-10-09
Computation and Language · Computer Science
The Dark Side of Human Feedback: Poisoning Large Language Models via User Inputs
Bocheng Chen, Hanqing Guo, Guangjing Wang, Yuanda Wang +1
2024-09-04
Computation and Language · Computer Science
Can Editing LLMs Inject Harm?
Canyu Chen, Baixiang Huang, Zekun Li, Zhaorun Chen +11
2026-01-15
Computation and Language · Computer Science
Multi-Trigger Poisoning Amplifies Backdoor Vulnerabilities in LLMs
Sanhanat Sivapiromrat, Caiqi Zhang, Marco Basaldella, Nigel Collier
2025-10-10
Cryptography and Security · Computer Science
PoisonBench: Assessing Large Language Model Vulnerability to Data Poisoning
Tingchen Fu, Mrinank Sharma, Philip Torr, Shay B. Cohen +2
2025-06-09
Cryptography and Security · Computer Science
When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations
Huaizhi Ge, Yiming Li, Qifan Wang, Yongfeng Zhang +1
2025-02-18
Machine Learning · Computer Science
Analyzing Federated Learning through an Adversarial Lens
Arjun Nitin Bhagoji, Supriyo Chakraborty, Prateek Mittal, Seraphin Calo
2019-11-26
Machine Learning · Computer Science
Is poisoning a real threat to LLM alignment? Maybe more so than you think
Pankayaraj Pathmanathan, Souradip Chakraborty, Xiangyu Liu, Yongyuan Liang +1
2025-06-10
Computation and Language · Computer Science
LLM Hypnosis: Exploiting User Feedback for Unauthorized Knowledge Injection to All Users
Almog Hilel, Riddhi Bhagwat, Idan Shenfeld, Jacob Andreas +1
2026-04-21