Skip to content
AI.info
News
Tools
Research
Learn
AI.info
Jerry Li
Explore Jerry Li on AI.info.
When Does Predictor-Based RL Align with Human Perception? A Study of Subjective Rewards in Codec-Based Speech Language Models
Are LLMs Reliable Rankers? Rank Manipulation via Two-Stage Token Optimization
Page 1