MATH · IN · MODELS
methods / Causal Validation / Causal interventions (steering) / Activation Steering (Addition) / Trajectory-Invariant Latent Refinement (TILR)

Trajectory-Invariant Latent Refinement (TILR)

Techniqueadvanced

A training-free intervention that extracts a low-rank invariant subspace via SVD of contrastive differences between a later- and earlier-checkpoint's latent reasoning trajectories, then at inference projects each step's refinement update onto only that subspace (gated by a norm-based reliability check) to stabilize latent chain-of-thought.

Used in (1 observation)

structure: Linear Subspace · models: GPT-2 Small, GPT-2 Medium, Qwen2.5-Math-1.5B · paper: Invariant Reasoning Directions in Latent Trajectories of Language Models