AI.info
Jiacheng Xu
Explore Jiacheng Xu on AI.info.
- Mo' Models, Mo' Problems: How to best select model pools when designing Multi-Agent Systems
- Entropy-Regularized Rank-Masked Policy Optimization for Test-Time Reinforcement Learning in Code Generation
- Two-Stage Reinforcement Learning for Sound and Adversarial Test Generation in Code LLMs
- ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration