AI.info
Latest Research — Page 4
Browse Latest Research on AI.info.
- Nonlinear Model Predictive Control of a Robotic Soft Esophagus
- MetaCaDI: A Meta-Learning Framework for Causal Discovery from Multiple Environments with Unknown Interventions
- GeoBridge: A Semantic-Anchored Multi-View Foundation Model Bridging Images and Text for Geo-Localization
- MergeVLA: Cross-Skill Model Merging Toward a Generalist Vision-Language-Action Agent
- FATE: A Formal Benchmark Series for Frontier Algebra of Multiple Difficulty Levels
- PF$Δ$: A Benchmark Dataset for Power Flow under Load, Generation, and Topology Variations
- ShowTable: Unlocking Creative Table Visualization with Collaborative Reflection and Refinement
- Degeneration of Sliding-Window Factor Graph Optimization into Iterated Extended Kalman Filtering
- BALMS: Benchmarking Agentic LLMs for Longitudinal Mental Health Sensing
- TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM
- Beyond Teacher Likelihood: Group-Calibrated On-Policy Distillation for Long-Context Reasoning
- IntroConformal: Conformal Factuality Guarantees for Large Vision-Language Models via Introspective Signals
- From Native Memes to Global Moderation: Cross-Cultural Evaluation of Vision-Language Models for Hateful Meme Detection
- RcAE: Recursive Reconstruction Framework for Unsupervised Industrial Anomaly Detection
- APPLE: Attribute-Preserving Pseudo-Labeling for Diffusion-Based Face Swapping
- Hierarchical Sparse Plus Low Rank Compression of LLM
- A receding-horizon multi-contact motion planner for legged robots in challenging environments
- Fairness Without Labels: Pseudo-Balancing for Bias Mitigation in Face Gender Classification
- On-the-Fly OVD Adaptation with FLAME: Few-shot Localization via Active Marginal-Samples Exploration
- EfficientFlow: Efficient Equivariant Flow Policy Learning for Embodied AI
- Continuous Vision-Language-Action Co-Learning with Semantic-Physical Alignment for Behavioral Cloning
- Ponimator: Unfolding Interactive Pose for Versatile Human-human Interaction Animation
- Inverse Autoregressive Flows for Zero Degree Calorimeter fast simulation
- Mull-Tokens: Modality-Agnostic Latent Thinking
- IndEgo: A Dataset of Industrial Scenarios and Collaborative Work for Egocentric Assistants
- ARROW: An Adaptive Rollout and Routing Method for Global Weather Forecasting
- OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing
- AtlasNLP: A Country-Aware Atlas of Dataset Representation in NLP
- Learning Native Continuation for Action Chunking Flow Policies
- PACT: Can Enterprise AI Assistants Be Trusted Under Pressure?
- Systematicity between Forms and Meanings across Languages Supports Efficient Communication
- PSR: Scaling Multi-Subject Personalized Image Generation with Pairwise Subject-Consistency Rewards
- Do LiDAR Language Models Really Understand Spatio-temporal Relationships?
- Emergent Misalignment is Easy, Narrow Misalignment is Hard
- Distributionally Robust Classification for Multi-source Unsupervised Domain Adaptation
- Temporal Concept Dynamics in Diffusion Models via Prompt-Conditioned Interventions
- MVU-Eval: Towards Multi-Video Understanding Evaluation for Multimodal LLMs
- Koala Gripper: Co-designing Robotic Grippers and Data-Capture Devices for Scaling Dexterous Manipulation Learning
- Is Finer Better? The Limits of Microscaling Formats in Large Language Models
- Steering and Rectifying Latent Representation Manifolds in Frozen Multi-modal LLMs for Video Anomaly Detection