AI.info
Xinggang Wang
Explore Xinggang Wang on AI.info.
- Spa3R: Predictive Spatial Field Modeling for 3D Visual Reasoning
- DriveLaW:Unifying Planning and Video Generation in a Latent Driving World
- SuperCLIP: CLIP with Simple Classification Supervision
- Towards Scalable Pre-training of Visual Tokenizers for Generation
- 4DLangVGGT: 4D Language-Visual Geometry Grounded Transformer
- MobileI2V: Fast and High-Resolution Image-to-Video on Mobile Devices
- Phys-Liquid: A Physics-Informed Dataset for Estimating 3D Geometry and Volume of Transparent Deformable Liquids