Sovenyr
Get early access
Signal
2026-07-23
Papers With Code
SLPO: Scaling Latent Reasoning via a Surrogate Policy
Part of
Advanced Inverse Reward And Prompt Engineering
Open primary source
See the whole picture