arxiv · arXiv · 2026-10-01 16:49 · 评分 75
提出PPO-HRAP混合机制感知策略,将近端策略优化与可解释机制先验结合用于交易。针对纯利润策略在上升趋势中退化为被动多头、过度风险惩罚在波动期过于防御的问题,在收益参与和回撤控制间取得平衡。
原文:arXiv | 返回 AI 资讯列表