Computation and Language · Computer Science
Steering Multimodal Large Language Models Decoding for Context-Aware Safety
Zheyuan Liu, Zhangchen Xu, Guangyao Dou, Xiangchi Yuan +3
2025-09-24
Computer Vision and Pattern Recognition · Computer Science
C-CoT: Counterfactual Chain-of-Thought with Vision-Language Models for Safe Autonomous Driving
Kefei Tian, Yuansheng Lian, Kai Yang, Xiangdong Chen +1
2026-05-12
Cryptography and Security · Computer Science
SFCoT: Safer Chain-of-Thought via Active Safety Evaluation and Calibration
Yu Pan, Wenlong Yu, Tiejun Wu, Xiaohu Ye +3
2026-03-17
Computation and Language · Computer Science
SoftCoT: Soft Chain-of-Thought for Efficient Reasoning with LLMs
Yige Xu, Xu Guo, Zhiwei Zeng, Chunyan Miao
2025-05-28
Artificial Intelligence · Computer Science
Improve Vision Language Model Chain-of-thought Reasoning
Ruohong Zhang, Bowen Zhang, Yanghao Li, Haotian Zhang +5
2024-10-22
Robotics · Computer Science
SafePlan: Leveraging Formal Logic and Chain-of-Thought Reasoning for Enhanced Safety in LLM-based Robotic Task Planning
Ike Obi, Vishnunandan L. N. Venkatesh, Weizheng Wang, Ruiqi Wang +4
2025-03-11
Artificial Intelligence · Computer Science
SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities
Fengqing Jiang, Zhangchen Xu, Yuetai Li, Luyao Niu +4
2025-02-18
Computer Vision and Pattern Recognition · Computer Science
VACoT: Rethinking Visual Data Augmentation with VLMs
Zhengzhuo Xu, Chong Sun, SiNan Du, Chen Li +2
2025-12-03
Computation and Language · Computer Science
FalseReject: A Resource for Improving Contextual Safety and Mitigating Over-Refusals in LLMs via Structured Reasoning
Zhehao Zhang, Weijie Xu, Fanyou Wu, Chandan K. Reddy
2025-07-16
Cryptography and Security · Computer Science
Enhancing Model Defense Against Jailbreaks with Proactive Safety Reasoning
Xianglin Yang, Gelei Deng, Jieming Shi, Tianwei Zhang +1
2026-01-29
Computer Vision and Pattern Recognition · Computer Science
Safety Alignment for Vision Language Models
Zhendong Liu, Yuanbi Nie, Yingshui Tan, Xiangyu Yue +4
2024-05-24
Computer Vision and Pattern Recognition · Computer Science
HomeGuard: VLM-based Embodied Safeguard for Identifying Contextual Risk in Household Task
Xiaoya Lu, Yijin Zhou, Zeren Chen, Ruocheng Wang +5
2026-03-17
Computer Vision and Pattern Recognition · Computer Science
LLaVA-CoT: Let Vision Language Models Reason Step-by-Step
Guowei Xu, Peng Jin, Ziang Wu, Hao Li +3
2025-07-22
Machine Learning · Computer Science
VLMGuard-R1: Proactive Safety Alignment for VLMs via Reasoning-Driven Prompt Optimization
Menglan Chen, Xianghe Pang, Jingjing Dong, WenHao Wang +2
2025-10-14
Computer Vision and Pattern Recognition · Computer Science
LaV-CoT: Language-Aware Visual CoT with Multi-Aspect Reward Optimization for Real-World Multilingual VQA
Jing Huang, Zhiya Tan, Shutao Gong, Fanwei Zeng +5
2026-04-15
Computation and Language · Computer Science
Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning
Kaviraj Pather, Elena Hadjigeorgiou, Arben Krasniqi, Claire Schmit +3
2025-12-30
Cryptography and Security · Computer Science
VLM-Guard: Safeguarding Vision-Language Models via Fulfilling Safety Alignment Gap
Qin Liu, Fei Wang, Chaowei Xiao, Muhao Chen
2025-02-18
Robotics · Computer Science
VLM-SAFE: Vision-Language Model-Guided Safety-Aware Reinforcement Learning with World Models for Autonomous Driving
Yansong Qu, Zilin Huang, Zihao Sheng, Jiancong Chen +3
2026-03-31
Computer Vision and Pattern Recognition · Computer Science
MiCo: Multi-image Contrast for Reinforcement Visual Reasoning
Xi Chen, Mingkang Zhu, Shaoteng Liu, Xiaoyang Wu +4
2025-06-30
Cryptography and Security · Computer Science
Mitigating the Safety-utility Trade-off in LLM Alignment via Adaptive Safe Context Learning
Yanbo Wang, Minzheng Wang, Jian Liang, Lu Wang +2
2026-02-17
Computer Vision and Pattern Recognition · Computer Science
See It, Say It, Sorted: An Iterative Training-Free Framework for Visually-Grounded Multimodal Reasoning in LVLMs
Yongchang Zhang, Oliver Ma, Tianyi Liu, Guangquan Zhou +1
2026-03-10