Computation and Language · Computer Science
H-CoT: Hijacking the Chain-of-Thought Safety Reasoning Mechanism to Jailbreak Large Reasoning Models, Including OpenAI o1/o3, DeepSeek-R1, and Gemini 2.0 Flash Thinking
Martin Kuo, Jianyi Zhang, Aolin Ding, Qinsi Wang +5
2025-02-28
Cryptography and Security · Computer Science
Hey GPT-OSS, Looks Like You Got It -- Now Walk Me Through It! An Assessment of the Reasoning Language Models Chain of Thought Mechanism for Digital Forensics
Gaëtan Michelet, Janine Schneider, Aruna Withanage, Frank Breitinger
2025-12-05
Computation and Language · Computer Science
Is GPT-OSS Good? A Comprehensive Evaluation of OpenAI's Latest Open Source Models
Ziqian Bi, Keyu Chen, Chiung-Yi Tseng, Danyang Zhang +8
2025-12-16
Computation and Language · Computer Science
ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models
Qianyu He, Siyu Yuan, Xuefeng Li, Mingxuan Wang +1
2025-08-27
Computation and Language · Computer Science
Safer Reasoning Traces: Measuring and Mitigating Chain-of-Thought Leakage in LLMs
Patrick Ahrend, Tobias Eder, Xiyang Yang, Zhiyi Pan +1
2026-03-09
Machine Learning · Computer Science
Is GPT-OSS All You Need? Benchmarking Large Language Models for Financial Intelligence and the Surprising Efficiency Paradox
Ziqian Bi, Danyang Zhang, Junhao Song, Chiung-Yi Tseng
2025-12-18
Artificial Intelligence · Computer Science
Faithful or Just Plausible? Evaluating the Faithfulness of Closed-Source LLMs in Medical Reasoning
Halimat Afolabi, Zainab Afolabi, Elizabeth Friel, Jude Roberts +12
2026-05-13
Computation and Language · Computer Science
An automatically discovered chain-of-thought prompt generalizes to novel models and datasets
Konstantin Hebenstreit, Robert Praas, Louis P Kiesewetter, Matthias Samwald
2023-08-04
Artificial Intelligence · Computer Science
Chain-of-Thought Hijacking
Jianli Zhao, Tingchen Fu, Rylan Schaeffer, Mrinank Sharma +1
2026-05-26
Computation and Language · Computer Science
A Comparative Study on Reasoning Patterns of OpenAI's o1 Model
Siwei Wu, Zhongyuan Peng, Xinrun Du, Tuney Zheng +13
2024-10-24
Machine Learning · Computer Science
POT: Inducing Overthinking in LLMs via Black-Box Iterative Optimization
Xinyu Li, Tianjin Huang, Ronghui Mu, Xiaowei Huang +1
2025-08-28
Computation and Language · Computer Science
Do LLMs Know They Are Being Tested? Evaluation Awareness and Incentive-Sensitive Failures in GPT-OSS-20B
Nisar Ahmed, Muhammad Imran Zaman, Gulshan Saleem, Ali Hassan
2025-10-13
Computation and Language · Computer Science
gpt-oss-120b & gpt-oss-20b Model Card
OpenAI, :, Sandhini Agarwal, Lama Ahmad +123
2025-08-18
Computation and Language · Computer Science
The Fragility of Chain-of-Thought Monitoring Across Typologically Diverse Languages
Eric Onyame, Runtao Zhou, Kowshik Thopalli, Bhavya Kailkhura +1
2026-05-28
Computation and Language · Computer Science
SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning
Chenzhi Hu, Qinzhe Hu, Yuhang Xu, Junyi Chen +5
2026-03-10
Cryptography and Security · Computer Science
SFCoT: Safer Chain-of-Thought via Active Safety Evaluation and Calibration
Yu Pan, Wenlong Yu, Tiejun Wu, Xiaohu Ye +3
2026-03-17
Computation and Language · Computer Science
Investigating the Efficacy of Large Language Models in Reflective Assessment Methods through Chain of Thoughts Prompting
Baphumelele Masikisiki, Vukosi Marivate, Yvette Hlope
2023-10-03
Cryptography and Security · Computer Science
Breaking Bad: Interpretability-Based Safety Audits of State-of-the-Art LLMs
Krishiv Agarwal, Ramneet Kaur, Colin Samplawski, Manoj Acharya +5
2026-04-24
Computers and Society · Computer Science
The Hidden Risks of Large Reasoning Models: A Safety Assessment of R1
Kaiwen Zhou, Chengzhi Liu, Xuandong Zhao, Shreedhar Jangam +4
2025-11-18
Artificial Intelligence · Computer Science
Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation
Bowen Baker, Joost Huizinga, Leo Gao, Zehao Dou +5
2025-03-18