AI.info
Sanghwan Jang
Explore Sanghwan Jang on AI.info.
- Difficulty-Adaptive Tree-Structured Policy Optimization for Expanding Reasoning Coverage in RLVR
- RA-VLA: Retrieval-Augmented VLA for Test-Time Adaptation
- BPL: Bias-adaptive Preference Distillation Learning for Recommender System
- STEPER: Step-wise Knowledge Distillation for Enhancing Reasoning Ability in Multi-Step Retrieval-Augmented Language Models