Yu, M., Huang, H., Yuan, L., Li, Y., Wang, K., & Jiang, Z. (2026). SafeEvo: Deciphering the Safety Alignment Mechanism and Evolution in Language Models. https://omanscience.com/ar/articles/safeevo-deciphering-the-safety-alignment-mechanism-and-evolution-in-language-models