Abstract

Large reasoning models (LRMs) incur high inference costs, often mitigated by efficiency techniques like quantization and pruning. However, the impact of these techniques on model adversarial robustness remains largely unexplored. This study provides the first comprehensive analysis of the interplay between efficiency, jailbreak vulnerability, and reasoning in LRMs. We find that while efficiency methods seemingly reduce the success rate of jailbreak attacks, this improvement is often superficial. It largely arises from degraded reasoning capabilities leading to "attempted but failed" malicious responses, rather than an increase in genuine alignment. Mechanistic analysis of representational drift confirms this, revealing a strict coupling between reasoning capability loss and the model's inability to maintain malicious semantic trajectories. Additionally, we identify quantization with pruning as the optimal strategy to balance efficiency and robustness. These findings clarify the distinction between true safety alignment and capability-induced failure, providing an empirical foundation for LRM deployment.

Keywords

Subject

Publication details

Journal
Not available
Open access
Green open access

Cite this article

APA 7

Yang, Y., Cao, Z., Wang, X., Zhou, X., Li, Y., Yang, D., & Zhao, H. (2026). On the Efficiency-Safety Dilemma in Large Reasoning Models. https://omanscience.com/en/articles/on-the-efficiency-safety-dilemma-in-large-reasoning-models

MLA 9

Yang, Yifei, et al. "On the Efficiency-Safety Dilemma in Large Reasoning Models." https://omanscience.com/en/articles/on-the-efficiency-safety-dilemma-in-large-reasoning-models.

Chicago (author–date)

Yang, Yifei, Zouying Cao, Xingrui Wang, Xiao Zhou, Yuexian Li, Dongjie Yang, and Hai Zhao. 2026. "On the Efficiency-Safety Dilemma in Large Reasoning Models." https://omanscience.com/en/articles/on-the-efficiency-safety-dilemma-in-large-reasoning-models.

Harvard

Yang, Y., Cao, Z., Wang, X., Zhou, X., Li, Y., Yang, D. and Zhao, H. (2026) 'On the Efficiency-Safety Dilemma in Large Reasoning Models', Available at: https://omanscience.com/en/articles/on-the-efficiency-safety-dilemma-in-large-reasoning-models.

Vancouver

Yang Y, Cao Z, Wang X, Zhou X, Li Y, Yang D, et al. On the Efficiency-Safety Dilemma in Large Reasoning Models. https://omanscience.com/en/articles/on-the-efficiency-safety-dilemma-in-large-reasoning-models

IEEE

Y. Yang, Z. Cao, X. Wang, X. Zhou, Y. Li, D. Yang, and H. Zhao, "On the Efficiency-Safety Dilemma in Large Reasoning Models," https://omanscience.com/en/articles/on-the-efficiency-safety-dilemma-in-large-reasoning-models.