Skip to content
AI.info
News
Tools
Research
Learn
AI.info
Haipeng Chen
Explore Haipeng Chen on AI.info.
Speculative Sampling with Reinforcement Learning
DIP: Dynamic In-Context Planner For Diffusion Language Models
Dynamic Retriever for In-Context Knowledge Editing via Policy Optimization
Offline Reinforcement Learning with Generative Trajectory Policies
Page 1