AI.info
Bohan Zeng
Explore Bohan Zeng on AI.info.
- AD-MIR: Bridging the Gap from Perception to Persuasion in Advertising Video Understanding via Structured Reasoning
- OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models
- Scone: Bridging Composition and Distinction in Subject-Driven Image Generation via Unified Understanding-Generation Modeling
- SVG-T2I: Scaling Up Text-to-Image Latent Diffusion Model Without Variational Autoencoder
- Are We Ready for RL in Text-to-3D Generation? A Progressive Investigation
- VABench: A Comprehensive Benchmark for Audio-Video Generation
- Rethinking Driving World Model as Synthetic Data Generator for Perception Tasks