Skip to content
AI.info
News
Tools
Research
Learn
AI.info
Aviral Kumar
Explore Aviral Kumar on AI.info.
$R^3$: Training Robots to Reason in Natural Language via Reinforcement Learning
TRIM: Hybrid Inference via Targeted Stepwise Routing in Multi-Step Reasoning Tasks
Page 1