AI.info
Latest Research — Page 17
Browse Latest Research on AI.info.
- WUSH: Near-Optimal Adaptive Transforms for LLM Quantization
- Can LLMs Help You at Work? A Sandbox for Evaluating LLM Agents in Enterprise Environments
- Detecting Generated Images by Fitting Natural Image Distributions
- CounterVid: Counterfactual Video Generation for Mitigating Action and Temporal Hallucinations in Video-Language Models
- Plug-and-Play Clarifier: A Zero-Shot Multimodal Framework for Egocentric Intent Disambiguation
- Mixing Importance with Diversity: Joint Optimization for KV Cache Compression in Large Vision-Language Models
- DUALFloodGNN: Physics-informed Graph Neural Network for Operational Flood Modeling
- Information-Theoretic Quality Metric of Low-Dimensional Embeddings
- SpecQuant: Spectral Decomposition and Adaptive Truncation for Ultra-Low-Bit LLMs Quantization
- AgentXRay: White-Boxing Agentic Systems via Workflow Reconstruction
- tttLRM: Test-Time Training for Long Context and Autoregressive 3D Reconstruction
- Decomposed Attention Fusion in MLLMs for Training-Free Video Reasoning Segmentation
- Protein Circuit Tracing via Cross-layer Transcoders
- Class-Partitioned VQ-VAE and Latent Flow Matching for Point Cloud Scene Generation
- SlicerOrbitSurgerySim: An Open-Source Platform for Virtual Registration and Quantitative Comparison of Preformed Orbital Plates
- OmniLottie: Generating Vector Animations via Parameterized Lottie Tokens
- Adam Reduces a Unique Form of Sharpness: Theoretical Insights Near the Minimizer Manifold
- SYMPHONY: Synergistic Multi-agent Planning with Heterogeneous Language Model Assembly
- Two-Step Occupation Coding
- SynCABEL: Synthetic Contextualized Augmentation for Biomedical Entity Linking
- Mixed Data Clustering Survey and Challenges
- Learning from Synthetic Data Improves Multi-hop Reasoning
- JavisGPT: A Unified Multi-modal LLM for Sounding-Video Comprehension and Generation
- Beyond Black-Box Interventions: Latent Probing for Faithful Retrieval-Augmented Generation
- Five Years of SciCap: What We Learned and Future Directions for Scientific Figure Captioning
- PLANA3R: Zero-shot Metric Planar 3D Reconstruction via Feed-Forward Planar Splatting
- Multi-modal Dynamic Proxy Learning for Personalized Multiple Clustering
- STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning
- A Lightweight Sparse Interaction Network for Time Series Forecasting
- AffectSim: A Controllable Interactive 3D Simulation Benchmark for Embodied Affective Perception
- Understanding Syllogistic Reasoning in LLMs from Formal and Natural Language Perspectives
- Re-coding for Uncertainties: Edge-awareness Semantic Concordance for Resilient Event-RGB Segmentation
- Towards Characterizing Knowledge Distillation of PPG Heart Rate Estimation Models
- Generative Modeling from Black-box Corruptions via Self-Consistent Stochastic Interpolants
- StructXLIP: Enhancing Vision-language Models with Multimodal Structural Cues
- Dynamic Rank Reinforcement Learning for Adaptive Low-Rank Multi-Head Self Attention in Large Language Models
- Human Mesh Modeling for Anny Body
- ReForm: Reflective Autoformalization with Prospective Bounded Sequence Optimization
- BaRISTA: Brain Scale Informed Spatiotemporal Representation of Human Intracranial Neural Activity
- ECG-R1: Protocol-Guided and Modality-Agnostic MLLM for Reliable ECG Interpretation