MATH · IN · MODELS

Custom Recurrent RL Policies

Academic

Structures found in this family (2)

By model (3)

Custom frozen multi-quadrotor navigation policy · research-scale
GRU policy (PPO, Procgen Jumper)
Mamba policy (PPO, Procgen Jumper)

Papers

Steering Multirobot Behavior via Closed-Loop Affine Activation Editing (2026), Unraveling the Hidden Dynamical Structure in Recurrent Neural Policies (2026)