PPO-HRAP: Proximal Policy Optimization with a Hybrid Regime-Aware Policy for Risk-Controlled Trading
Updated
Updated · arxiv.org · Oct 1
PPO-HRAP: Proximal Policy Optimization with a Hybrid Regime-Aware Policy for Risk-Controlled Trading
1 articles · Updated · arxiv.org · Oct 1
Summary
Researchers have introduced PPO-HRAP, a hybrid reinforcement learning policy for trading that blends Proximal Policy Optimization with a regime-aware action prior.
PPO-HRAP aims to balance return and drawdown control by incorporating market trends and volatility signals, outperforming several financial and RL baselines on SPY, QQQ, and DIA.
The method reduces maximum drawdown and improves risk-adjusted returns, suggesting hybrid control-plus-learning approaches offer practical benefits for risk-managed trading strategies.