AI.info
Xinlong Chen
Explore Xinlong Chen on AI.info.
- RefCaptioner: Multi-Reference Image-Grounded Video Captioning
- Beyond Closed-Pool Video Retrieval: A Benchmark and Agent Framework for Real-World Video Search and Moment Localization
- TimeChat-Captioner: Scripting Multi-Scene Videos with Time-Aware and Structural Audio-Visual Captions
- OmniSIFT: Modality-Asymmetric Token Compression for Efficient Omni-modal Large Language Models
- ShotFinder: Imagination-Driven Open-Domain Video Shot Retrieval via Web Search
- GRAN-TED: Generating Robust, Aligned, and Nuanced Text Embedding for Diffusion Models
- VABench: A Comprehensive Benchmark for Audio-Video Generation