Deng, H., Yan, Z., Liu, X., Nie, S., Wang, Y., Wang, C., Zhang, Z., Jiang, T., Xiao, Q., Zhang, J., & Zhang, M. (2026). GRPODropout: Less is More for Online Reinforcement Learning Rollouts. https://omanscience.com/ar/articles/grpodropout-less-is-more-for-online-reinforcement-learning-rollouts