AI.info
Zhiwei Zhang
Explore Zhiwei Zhang on AI.info.
- Multi-Head Low-Rank Attention
- How Far Are LLMs from Professional Poker Players? Revisiting Game-Theoretic Reasoning with Agentic Tool Use
- Robust Tool Use via Fission-GRPO: Learning to Recover from Execution Errors
- dMLLM-TTS: Self-Verified and Efficient Test-Time Scaling for Diffusion Multi-Modal Large Language Models