AI 编程 › AI 资讯 › 正文

PPO-HRAP: Proximal Policy Optimization with a Hybrid Regime-Aware Policy for Risk-Controlled Trading

arxiv · arXiv · 2026-10-01 16:49 · 评分 75

提出PPO-HRAP混合机制感知策略,将近端策略优化与可解释机制先验结合用于交易。针对纯利润策略在上升趋势中退化为被动多头、过度风险惩罚在波动期过于防御的问题,在收益参与和回撤控制间取得平衡。

原文:arXiv | 返回 AI 资讯列表