AI.info
Kailun Yang
Explore Kailun Yang on AI.info.
- Do LiDAR Language Models Really Understand Spatio-temporal Relationships?
- PROVIA: Procedure State Tracking for Online Mistake Detection in Egocentric Videos
- Spheriverse: 3D Scene Understanding from Spherical Observations in the Wild
- GuideFetch: A Task Coordination Framework for Concurrent Navigation and Object Retrieval in Assistive Robot Dogs
- HGeo-TopoMap: Boosting Topological Mapping with Hierarchical Geometric Priors
- BLaDA: Bridging Language to Functional Dexterous Actions within 3DGS Fields
- O3N: Omnidirectional Open-Vocabulary Occupancy Prediction
- Towards Universal Computational Aberration Correction in Photographic Cameras: A Comprehensive Benchmark Analysis
- PanoAffordanceNet: Towards Holistic Affordance Grounding in 360° Indoor Environments
- $M^2$-Occ: Resilient 3D Semantic Occupancy Prediction for Autonomous Driving with Incomplete Camera Inputs
- OccTrack360: 4D Panoptic Occupancy Tracking from Surround-View Fisheye Cameras
- Spherical-GOF: Geometry-Aware Panoramic Gaussian Opacity Fields for 3D Scene Reconstruction
- NOVA: Next-step Open-Vocabulary Autoregression for 3D Multi-Object Tracking in Autonomous Driving
- Can we Trust Unreliable Voxels? Exploring 3D Semantic Occupancy Prediction under Label Noise
- TRACER: Texture-Robust Affordance Chain-of-Thought for Deformable-Object Refinement
- Learning Fine-Grained Correspondence with Cross-Perspective Perception for Open-Vocabulary 6D Object Pose Estimation
- OneOcc: Semantic Occupancy Prediction for Legged Robots with a Single Panoramic Camera
- OmniTrack++: Omnidirectional Multi-Object Tracking by Learning Large-FoV Trajectory Feedback
- Large-FOV RGBD Imaging via Structured PSF Coding in a Bio-inspired Monocentric System
- RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
- EReLiFM: Evidential Reliability-Aware Residual Flow Meta-Learning for Open-Set Domain Generalization under Noisy Labels
- mmWalk: Towards Multi-modal Multi-view Walking Assistance
- Situat3DChange: Situated 3D Change Understanding Dataset for Multimodal Large Language Model