الملخص
Reinforcement learning (RL) policies can deteriorate under out-of-distribution (OOD) magnitude shifts. Starting from soft actor-critic (SAC) and its Bayesian Amnesic Piecewise-Robust (BAPR) predecessor, we study the causal-symbolic BAPR (CS-BAPR) family. The practical method combines six training-stabilization settings with alternative actor heads: a Neural Addition Unit (NAU) with a Neural Multiplication Unit (NMU)-inspired quadratic correction, a Kolmogorov-Arnold Network (KAN), or a multilayer perceptron (MLP) with rectified linear unit (ReLU) or hyperbolic-tangent activations.
الكلمات المفتاحية
الموضوع
بيانات النشر
- المجلة
- غير متاح
- وصول مفتوح
- وصول مفتوح أخضر
اقتبس هذه المقالة
APA 7
Zhang, Y., & Zheng, L. (2026). Arithmetic Actor Heads and Training Stabilization for Out-of-Distribution Reinforcement Learning. https://omanscience.com/ar/articles/arithmetic-actor-heads-and-training-stabilization-for-out-of-distribution-reinforcement-learning
MLA 9
Zhang, Yifan, and Liang Zheng. "Arithmetic Actor Heads and Training Stabilization for Out-of-Distribution Reinforcement Learning." https://omanscience.com/ar/articles/arithmetic-actor-heads-and-training-stabilization-for-out-of-distribution-reinforcement-learning.
شيكاغو (المؤلف–التاريخ)
Zhang, Yifan, and Liang Zheng. 2026. "Arithmetic Actor Heads and Training Stabilization for Out-of-Distribution Reinforcement Learning." https://omanscience.com/ar/articles/arithmetic-actor-heads-and-training-stabilization-for-out-of-distribution-reinforcement-learning.
هارفارد
Zhang, Y. and Zheng, L. (2026) 'Arithmetic Actor Heads and Training Stabilization for Out-of-Distribution Reinforcement Learning', Available at: https://omanscience.com/ar/articles/arithmetic-actor-heads-and-training-stabilization-for-out-of-distribution-reinforcement-learning.
فانكوفر
Zhang Y, Zheng L. Arithmetic Actor Heads and Training Stabilization for Out-of-Distribution Reinforcement Learning. https://omanscience.com/ar/articles/arithmetic-actor-heads-and-training-stabilization-for-out-of-distribution-reinforcement-learning
IEEE
Y. Zhang, and L. Zheng, "Arithmetic Actor Heads and Training Stabilization for Out-of-Distribution Reinforcement Learning," https://omanscience.com/ar/articles/arithmetic-actor-heads-and-training-stabilization-for-out-of-distribution-reinforcement-learning.