AI.info
Chaofan Tao
Explore Chaofan Tao on AI.info.
- From Verifiable Dot to Reward Chain: Harnessing Verifiable Reference-based Rewards for Reinforcement Learning of Open-ended Generation
- MMDeepResearch-Bench: A Benchmark for Multimodal Deep Research Agents
- Find Your Optimal Teacher: Personalized Data Synthesis via Router-Guided Multi-Teacher Distillation