Updated
Updated · arxiv.org · Oct 1
PPO-HRAP: Proximal Policy Optimization with a Hybrid Regime-Aware Policy for Risk-Controlled Trading
Updated
Updated · arxiv.org · Oct 1

PPO-HRAP: Proximal Policy Optimization with a Hybrid Regime-Aware Policy for Risk-Controlled Trading

1 articles · Updated · arxiv.org · Oct 1

Summary

  • Researchers have introduced PPO-HRAP, a hybrid reinforcement learning policy for trading that blends Proximal Policy Optimization with a regime-aware action prior.
  • PPO-HRAP aims to balance return and drawdown control by incorporating market trends and volatility signals, outperforming several financial and RL baselines on SPY, QQQ, and DIA.
  • The method reduces maximum drawdown and improves risk-adjusted returns, suggesting hybrid control-plus-learning approaches offer practical benefits for risk-managed trading strategies.