AI.info
Latest Research — Page 95
Browse Latest Research on AI.info.
- Text to Robotic Assembly of Multi Component Objects using 3D Generative AI and Vision Language Models
- CitiLink-Minutes: A Multilayer Annotated Dataset of Municipal Meeting Minutes
- Personalized Privacy Control in LLMs via Attention Head Intervention
- On Imbalanced Regression with Hoeffding Trees
- EchoFoley: Event-Centric Hierarchical Control for Video Grounded Creative Sound Generation
- Exploiting Domain Properties in Language-Driven Domain Generalization for Semantic Segmentation
- Total Cost of Agency: Exact Attribution of Memory Injection Cost in Multi-Agent LLM Workflows
- Enhancing Graph Classification Robustness with Singular Pooling
- Subgraph Federated Learning via Spectral Methods
- Foundation Model-Enabled Efficient Data Sampling (FEEDS): A label-efficient training strategy for pan-cancer, multi-tracer PET/CT datasets
- R1-SyntheticVL: Is Synthetic Data from Generative Models Ready for Multimodal Large Language Model?
- LiteMVS: Efficient Multi-View Stereo with Foundation Distillation and Expert Aggregation
- Probing Neural Combinatorial Optimization Models
- DeepRWCap: Neural-Guided Random-Walk Capacitance Solver for IC Design
- Why Keep Your Doubts to Yourself? Trading Visual Uncertainties in Multi-Agent Bandit Systems
- Empirical Stability Analysis of Kolmogorov-Arnold Networks in Hard-Constrained Recurrent Physics-Informed Discovery
- Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities
- LiDAR-GS++:Improving LiDAR Gaussian Reconstruction via Diffusion Priors
- Artificial Hippocampus Networks for Efficient Long-Context Modeling
- 3D sans 3D Scans: Scalable Pre-training from Video-Generated Point Clouds
- Moral Change or Noise? On Problems of Aligning AI With Temporally Unstable Human Feedback
- Orthogonium : A Unified, Efficient Library of Orthogonal and 1-Lipschitz Building Blocks
- VIP-MINGLE: A Corpus for Videoconference and In-Person Multimodal Interaction in Group Language Engagement
- ReFuGe: Feature Generation for Prediction Tasks on Relational Databases with LLM Agents
- Enhancing XR Auditory Realism via Multimodal Scene-Aware Acoustic Rendering
- FATHOMS-RAG: A Framework for the Assessment of Thinking and Observation in Multimodal Systems that use Retrieval Augmented Generation
- Discrete diffusion samplers and bridges: Off-policy algorithms and applications in latent spaces
- PosteriorBench: From Point Estimates to Posterior Matching in Evaluating Generative Inverse Solvers
- URaG: Unified Retrieval and Generation in Multimodal LLMs for Efficient Long Document Understanding
- Beyond URLs: Metadata Diversity and Position for Efficient LLM Pretraining
- Target-Aware Calibration Data Selection for Preserving Uncertainty in Quantized Language Models
- Real-Time 4D Radar Perception for Robust Human Detection in Harsh Enclosed Environments
- NegoCollab: A Common Representation Negotiation Approach for Heterogeneous Collaborative Perception
- Scene Coordinate Reconstruction Priors
- CoBia: Constructed Conversations Can Trigger Otherwise Concealed Societal Biases in LLMs
- Chopping Trees: Semantic Similarity Based Dynamic Pruning for Tree-of-Thought Reasoning
- Mise-en-Scène: Implicit Layout Emergence in Diffusion Transformers for Human-AI Design Co-Creation
- Saving Foundation Flow-Matching Priors for Inverse Problems
- Learning to Refocus with Video Diffusion Models
- FaStfact: Faster, Stronger Long-Form Factuality Evaluations in LLMs