AI.info
Latest Research — Page 24
Browse Latest Research on AI.info.
- MoDora: Tree-Based Semi-Structured Document Analysis System
- AnyBCQ: Hardware Efficient Flexible Binary-Coded Quantization for Multi-Precision LLMs
- Goal Force: Teaching Video Models To Accomplish Physics-Conditioned Goals
- Diffusion Guided Adversarial State Perturbations in Reinforcement Learning
- FicSim: A Dataset for Multi-Faceted Semantic Similarity in Long-Form Fiction
- GenCP: Towards Generative Modeling Paradigm of Coupled Physics
- Learning Correlated Reward Models: Statistical Barriers and Opportunities
- Compensating Distribution Drifts in Class-incremental Learning of Pre-trained Vision Transformers
- Spatiotemporal Wildfire Prediction and Reinforcement Learning for Helitack Suppression
- Knowledge-Guided Multimodal Reasoning over Interacting Streams for Video-Level Ambivalence and Hesitancy Recognition
- A Graph-based RAG for Energy Efficiency Question Answering
- Resource-constrained Amazons chess decision framework integrating large language models and graph attention
- Responsible Evaluation of AI for Mental Health
- AsymSpec: Context-Asymmetric Speculative Decoding for Agentic LLMs
- Diagnose, Correct, and Learn from Manipulation Failures via Visual Symbols
- iReasoner: Trajectory-Aware Intrinsic Reasoning Supervision for Self-Evolving Large Multimodal Models
- EgoExoMoCap: Distributed Ego-Exo Human Motion Capture
- Rethinking On-policy Optimization for Query Augmentation
- CropVLM: Learning to Zoom for Fine-Grained Vision-Language Perception
- Sample from What You See: Visuomotor Policy Learning via Diffusion Bridge with Observation-Embedded Stochastic Differential Equation
- Safety Generalization Under Distribution Shift in Safe Reinforcement Learning: A Diabetes Testbed
- Learning from Demonstrations via Capability-Aware Goal Sampling
- GAIA: A Data Flywheel System for Training GUI Test-Time Scaling Critic Models
- Situation Graph Prediction for User Perspective Modeling
- BabyVLM-V2: Toward Developmentally Grounded Pretraining and Benchmarking of Vision Foundation Models
- D2C-Routing: Dimension-to-Composition Evidence Routing for Mixed-Origin AI-Generated Text Detection
- How Far Are LLMs from Professional Poker Players? Revisiting Game-Theoretic Reasoning with Agentic Tool Use
- Beyond Satisfaction: From Placebic to Actionable Explanations For Enhanced Understandability
- Towards General Modality Translation with Contrastive and Predictive Latent Diffusion Bridge
- Reasoning-Aware Multimodal Fusion for Hateful Video Detection
- Algorithmic Gender Prediction Is Illegitimate, But Gender Imputation Can Yield Valid Measurements
- Meta-learning In-Context Enables Training-Free Cross Subject Brain Decoding
- Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?
- Policy Learning with Abstention
- Seeing the Unseen: Zooming in the Dark with Event Cameras
- VADTree: Explainable Training-Free Video Anomaly Detection via Hierarchical Granularity-Aware Tree
- MADA-RL: Multi-Agent Debate-Aware Reinforcement Learning for Parameter-Efficient Reasoning in Compact Models
- MemeArena: Automating Context-Aware Unbiased Evaluation of Harmfulness Understanding for Multimodal Large Language Models
- Reproducing DragDiffusion: Interactive Point-Based Editing with Diffusion Models
- What Does Preference Learning Recover from Pairwise Comparison Data?