Custom Recurrent RL Policies
Academic
Structures found in this family (2)
By model (3)
Custom frozen multi-quadrotor navigation policy · research-scale
GRU policy (PPO, Procgen Jumper)
Mamba policy (PPO, Procgen Jumper)
Observations (2)
Papers
Steering Multirobot Behavior via Closed-Loop Affine Activation Editing (2026), Unraveling the Hidden Dynamical Structure in Recurrent Neural Policies (2026)