AI.info
Yongliang Shen
Explore Yongliang Shen on AI.info.
- PaperGym: Rubric-Centered Evolution for Research-Plan Generation
- TTPO: Test-Time Policy Optimization
- Agent-G$^2$: Gaussian Guidance for Agentic Reinforcement Learning
- Pass the Baton: Trajectory-Relayed On-Policy Distillation
- How Controllable Are Large Language Models? A Unified Evaluation across Behavioral Granularities
- InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
- SpatialLadder: Progressive Training for Spatial Reasoning in Vision-Language Models