AI.info
Zhiheng Xi
Explore Zhiheng Xi on AI.info.
- ChartE$^{3}$: A Comprehensive Benchmark for End-to-End Chart Editing
- AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security
- Which Reasoning Trajectories Teach Students to Reason Better? A Simple Metric of Informative Alignment
- Counteracting Matthew Effect in Self-Improvement of LVLMs through Head-Tail Re-balancing
- Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
- BAPO: Stabilizing Off-Policy Reinforcement Learning for LLMs via Balanced Policy Optimization with Adaptive Clipping