AI.info
Latest Research — Page 59
Browse Latest Research on AI.info.
- Co-Learning for Missing Arbitrary Modalities in Multi-modal Classification
- Rethinking Surgical Smoke: A Smoke-Type-Aware Laparoscopic Video Desmoking Method and Dataset
- CLAWS:Creativity detection for LLM-generated solutions using Attention Window of Sections
- Wanderland: Geometrically Grounded Simulation for Open-World Embodied AI
- Calibrated Multimodal Representation Learning with Missing Modalities
- Doc-PP: Document Policy Preservation Benchmark for Large Vision-Language Models
- AgentLeak: A Benchmark for Internal-Channel Privacy Leakage in Multi-Agent LLM Systems
- To Steer or Not to Steer? Mechanistic Error Reduction with Abstention for Language Models
- MoonSeg3R: Monocular Online Zero-Shot Segment Anything in 3D with Reconstructive Foundation Priors
- VTimeCoT: Thinking by Drawing for Video Temporal Grounding and Reasoning
- CAViT -- Channel-Aware Vision Transformer for Dynamic Feature Fusion
- Loss Landscape Geometry of Partial Differential Equation Emulators: Or, Symmetry Learning via Gradient Alignment
- Learning to Attract and Repel: Dual Quality Margin Learning for Face Recognition (DQM-Face)
- Abstracted Away: Resisting Alienation and Ungrounded Abstraction in AI Research Communities
- Scaling Small Agents Through Strategy Auctions
- PPE: Positional Preservation Embedding for Token Compression in Multimodal Large Language Models
- GuideFlow3D: Optimization-Guided Rectified Flow For Appearance Transfer
- Learning to Generate and Extract: A Multi-Agent Collaboration Framework For Zero-shot Document-level Event Arguments Extraction
- Representation Handoffs for OpenArm-Based Laboratory Mobile Manipulation
- Guardian: Detecting Robotic Planning and Execution Errors with Vision-Language Models
- ReWeaver: Towards Simulation-Ready and Topology-Accurate Garment Reconstruction
- EnvHarness: Awakening Static Worlds for Agent Learning
- Agentic Reinforcement Learning with Observation-Calibrated Self-Distillation
- Convergence of Muon with Newton-Schulz
- Mimic Human Cognition, Master Multi-Image Reasoning: A Meta-Action Framework for Enhanced Visual Understanding
- 3D4D: An Interactive, Editable, 4D World Model via 3D Video Generation
- Smart IoT-Based Leak Forecasting and Detection for Energy-Efficient Liquid Cooling in AI Data Centers
- Sample-efficient and Scalable Exploration in Continuous-Time RL
- Concept Tokens: Learning Behavioral Embeddings Through Concept Definitions
- VideoAuto-R1: Video Auto Reasoning via Thinking Once, Answering Twice
- CanonicalPhys: Pose-Robust Remote Photoplethysmography via Canonical-Space Priors
- SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose Manipulation
- Dexterous Manipulation Transfer via Progressive Kinematic-Dynamic Alignment
- 3-Model Speculative Decoding
- MMGR: Multi-Modal Generative Reasoning Benchmark and Evaluation
- MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
- Scaling Multi-Agent Systems with Prospect-State Propagation
- QiMeng-SALV: Signal-Aware Learning for Verilog Code Generation
- MetaPerch: Learning from metadata for bioacoustics foundation models
- MDND: Unsupervised Learning Guided by Non-Differentiable Refinement for Shape Correspondence