Test-Time Compute & Efficiency
HiLS-Attention achieves 64x context extrapolation. GATS eliminates LLM calls with 100% planning success. SLPO surrogate policy for latent reasoning scaling. Efficiency gains critical for real-time world model deployment. Inference-time scaling trend noted but lacks architectural novelty.
Sources (2)
Updated Jul 27, 2026