AI.info
Latest Research — Page 65
Browse Latest Research on AI.info.
- ResearStudio: A Human-Intervenable Framework for Building Controllable Deep-Research Agents
- Hierarchical Concept Embedding & Pursuit for Interpretable Image Classification
- Deadline-Aware, Energy-Efficient Control of Domestic Immersion Hot Water Heater
- Causal-HalBench: Uncovering LVLMs Object Hallucinations Through Causal Intervention
- MoFu: Scale-Aware Modulation and Fourier Fusion for Multi-Subject Video Generation
- Beyond VLM-Based Rewards: Diffusion-Native Latent Reward Modeling
- HiPRAG: Hierarchical Process Rewards for Efficient Agentic Retrieval Augmented Generation
- Masking Matters: Unlocking the Spatial Reasoning Capabilities of LLMs for 3D Scene-Language Understanding
- Shortcut learning in geometric knot classification
- Vascular anatomy-aware self-supervised pre-training for X-ray angiogram analysis
- CoIDO: Efficient Data Selection for Visual Instruction Tuning via Coupled Importance-Diversity Optimization
- Unsupervised Learning of Cell Instances with Generative Routing Pyramids
- TS-Arena -- A Live Forecast Pre-Registration Platform
- What AI Speaks for Your Community: Polling AI Agents for Public Opinion on Data Center Projects
- MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution under Distribution Shifts
- Seeing Across Views: Benchmarking Spatial Reasoning of Vision-Language Models in Robotic Scenes
- Advances, challenges, and opportunities for legged robots
- Reimagining the Augmented Reality Accessibility Ecosystem for Deaf Students: Service Provider Perspectives in Experiential Learning
- A Translational Note on AI Safety Evaluation
- FIA-Edit: Frequency-Interactive Attention for Efficient and High-Fidelity Inversion-Free Text-Guided Image Editing
- RELIC: Revealed Principles for Learning Interpretable Composable Skills in Multi-Agent Planning
- Epistemic Trustworthiness in Generative AI: A Normative Framework for Warranted Reliance in High-Stakes Workflows
- PhotoFramer: Multi-modal Image Composition Instruction
- LangMark: A Multilingual Dataset for Automatic Post-Editing
- BooM-VVT: Boosting Mask-Free Video Virtual Try-On with Image-Level Pseudo Data
- Continuum Robot Localization using Distributed Time-of-Flight Sensors
- Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
- Object-WIPER : Training-Free Object and Associated Effect Removal in Videos
- Pixel-Perfect Depth with Semantics-Prompted Diffusion Transformers
- When Distance Distracts: Representation Distance Bias in BT-Loss for Reward Models
- Can LLMs Write Faithfully? An Agent-Based Evaluation of LLM-generated Islamic Content
- MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models
- Learning Massively Multitask World Models for Continuous Control
- ReBeCA: Unveiling Interpretable Behavior Hierarchy behind the Iterative Self-Reflection of Language Models with Causal Analysis
- Explainable Melanoma Diagnosis with Contrastive Learning and LLM-based Report Generation
- AFTER: Mitigating the Object Hallucination of LVLM via Adaptive Factual-Guided Activation Editing
- PaSE: Prototype-aligned Calibration and Shapley-based Equilibrium for Multimodal Sentiment Analysis
- Hear What Matters! Text-conditioned Selective Video-to-Audio Generation
- APEX-Accounting
- Concerto: Joint 2D-3D Self-Supervised Learning Emerges Spatial Representations