Machine Learning · Computer Science
DP2Unlearning: An Efficient and Guaranteed Unlearning Framework for LLMs
Tamim Al Mahmud, Najeeb Jebreel, Josep Domingo-Ferrer, David Sanchez
2025-07-21
Computation and Language · Computer Science
A Comprehensive Survey of Machine Unlearning Techniques for Large Language Models
Jiahui Geng, Qing Li, Herbert Woisetschlaeger, Zongxiong Chen +5
2025-06-03
Computation and Language · Computer Science
PRISM: A Unified Framework for Post-Training LLMs Without Verifiable Rewards
Mukesh Ghimire, Aosong Feng, Liwen You, Youzhi Luo +2
2026-01-21
Computation and Language · Computer Science
Do LLMs Really Forget? Evaluating Unlearning with Knowledge Correlation and Confidence Awareness
Rongzhe Wei, Peizhi Niu, Hans Hao-Hsun Hsu, Ruihan Wu +8
2025-10-23
Optimization and Control · Mathematics
Verifiable Model-Free Safety Filters via Reinforcement Learning
Bihui Yin, Yiwen Lu, Yuchen Jiang, Yilin Mo
2026-05-08
Computation and Language · Computer Science
Simplicity Prevails: Rethinking Negative Preference Optimization for LLM Unlearning
Chongyu Fan, Jiancheng Liu, Licong Lin, Jinghan Jia +3
2025-10-21
Machine Learning · Computer Science
Inference-time Unlearning Using Conformal Prediction
Somnath Basu Roy Chowdhury, Rahul Kidambi, Avinava Dubey, David Wang +3
2026-02-04
Robotics · Computer Science
Guiding Reinforcement Learning with Incomplete System Dynamics
Shuyuan Wang, Jingliang Duan, Nathan P. Lawrence, Philip D. Loewen +3
2024-10-25
Machine Learning · Computer Science
LLMs Can Learn to Reason Via Off-Policy RL
Daniel Ritter, Owen Oertell, Bradley Guo, Jonathan Chang +2
2026-03-03
Computation and Language · Computer Science
Unlearning Isn't Deletion: Investigating Reversibility of Machine Unlearning in LLMs
Xiaoyu Xu, Xiang Yue, Yang Liu, Qingqing Ye +4
2026-05-19
Machine Learning · Computer Science
Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning
Yicheng Lang, Yihua Zhang, Chongyu Fan, Changsheng Wang +2
2026-04-21
Machine Learning · Computer Science
Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning
Ruiqi Zhang, Licong Lin, Yu Bai, Song Mei
2024-10-14
Machine Learning · Computer Science
When Forgetting Builds Reliability: LLM Unlearning for Reliable Hardware Code Generation
Yiwen Liang, Qiufeng Li, Shikai Wang, Weidong Cao
2025-12-08
Multiagent Systems · Computer Science
Secure Forgetting: A Framework for Privacy-Driven Unlearning in Large Language Model (LLM)-Based Agents
Dayong Ye, Tainqing Zhu, Congcong Zhu, Feng He +4
2026-04-02
Machine Learning · Computer Science
Guided Flows for Generative Modeling and Decision Making
Qinqing Zheng, Matt Le, Neta Shaul, Yaron Lipman +2
2023-12-11
Machine Learning · Computer Science
Bridging the Gap Between Preference Alignment and Machine Unlearning
Xiaohua Feng, Yuyuan Li, Huwei Ji, Jiaming Zhang +3
2025-04-10
Computation and Language · Computer Science
Training-Free Group Relative Policy Optimization
Yuzheng Cai, Siqi Cai, Yuchen Shi, Zihan Xu +9
2025-10-10
Artificial Intelligence · Computer Science
Reinforcement Learning with External Knowledge by using Logical Neural Networks
Daiki Kimura, Subhajit Chaudhury, Akifumi Wachi, Ryosuke Kohita +3
2021-03-04