AI.info
Yu Meng
Explore Yu Meng on AI.info.
- Negative Self-Distillation: Learning to Reason by Avoiding Flaws
- Think Deep, Not Just Long: Measuring LLM Reasoning Effort via Deep-Thinking Tokens
- AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning
- Separate the Wheat from the Chaff: Winnowing Down Divergent Views in Retrieval Augmented Generation