AI.info
Rui Zheng
Explore Rui Zheng on AI.info.
- UBone3D: Physics-Rectified Conditional Flow Matching for Anatomical 3D Shape Completion from Ultrasound
- Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
- BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping