AI.info
Yifan Wang
Explore Yifan Wang on AI.info.
- MA-VLA: Multi-Arm Vision-Language-Action Model for Collaboration and Compositional Generalization
- CSRv2: Unlocking Ultra-Sparse Embeddings
- Neural Estimation of Pairwise Mutual Information in Masked Discrete Sequence Models
- Identifying and Correcting Label Noise for Robust GNNs via Influence Contradiction
- Render-of-Thought: Rendering Textual Chain-of-Thought as Images for Visual Latent Reasoning
- G$^2$VLM: Geometry Grounded Vision Language Model with Unified 3D Reconstruction and Spatial Reasoning
- VisReason: A Large-Scale Dataset for Visual Chain-of-Thought Reasoning
- MdaIF: Robust One-Stop Multi-Degradation-Aware Image Fusion with Language-Driven Semantics
- SPAN: Spatial-Projection Alignment for Monocular 3D Object Detection
- A Survey on Efficient Large Language Model Training: From Data-centric Perspectives
- From Forecasting to Planning: Policy World Model for Collaborative State-Action Prediction