AI.info
Latest Research — Page 25
Browse Latest Research on AI.info.
- Personality-guided Public-Private Domain Disentangled Hypergraph-Former Network for Multimodal Depression Detection
- Active Diffusion-Based Inference for Ill-Posed Inverse Problems under Incomplete Priors
- A Survey of Large Models in Sports
- MUVR: A Multi-Modal Untrimmed Video Retrieval Benchmark with Multi-Level Visual Correspondence
- SynQuE: Estimating Synthetic Dataset Quality Without Annotations
- When Benign Inputs Lead to Severe Harms: Eliciting Unsafe Unintended Behaviors of Computer-Use Agents
- The safety failures we are not instrumenting: a perspective on hidden safety-critical challenges in modern AI systems
- Poisoning Agentic Alpha: Adversarial Vulnerabilities Across Roles and Architectures in Multi-Agent Trading Systems
- Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models
- Towards Integrating Uncertainty for Domain-Agnostic Segmentation
- Expressive Temporal Specifications for Reward Monitoring
- WSBD: Freezing-Based Optimizer for Quantum Neural Networks
- FaceCam: Portrait Video Camera Control via Scale-Aware Conditioning
- Characterizing Agentic Flooding of Government Services
- MOT-SR: Multi-Objective Tool-Augmented Scientific Equation Discovery with Large Language Models
- SciForma: Structure-Faithful Generation of Scientific Diagrams
- Improving Domain Generalization in Contrastive Learning using Adaptive Temperature Control
- GlossoGen: Emergent Language in Complex Multi-Agent LLM Interactions
- Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
- MotionEdit: Benchmarking and Learning Motion-Centric Image Editing
- Online Optimization for Offline Safe Reinforcement Learning
- Cataract-LMM Large-Scale Multi-Source Multi-Task Benchmark for Deep Learning in Surgical Video Analysis
- Agent-in-the-Loop: A Data Flywheel for Continuous Improvement in LLM-based Customer Support
- Navigating the Alignment-Calibration Trade-off: A Pareto-Superior Frontier via Model Merging
- Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation
- How Sampling Affects the Detectability of Machine-written texts: A Comprehensive Study
- Actions Have Consequences: Detecting Outcome Performativity using Intervention Testing
- Learning When to Trust via Selective Context Preference Optimization
- Latent Collaboration in Multi-Agent Systems
- InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training
- Objective vs. Search: Decomposing What Makes a Good Tokeniser
- Rethinking Video Generation Model for the Embodied World
- Inter-Agent Trust Models: A Comparative Study of Brief, Claim, Proof, Stake, Reputation and Constraint in Agentic Web Protocol Design-A2A, AP2, ERC-8004, and Beyond
- ASCIIBench: Evaluating Language-Model-Based Understanding of Visually-Oriented Text
- RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks?
- ObjEmbed: Towards Universal Multimodal Object Embeddings
- Reasoning With a Star: A Heliophysics Dataset and Benchmark for Agentic Scientific Reasoning
- OpenSec: Measuring Incident Response Agent Calibration Under Adversarial Evidence
- T2SMark: Balancing Robustness and Diversity in Noise-as-Watermark for Diffusion Models
- QuranicMMLU: A Cognitively-Aware Benchmark for Evaluating Generative AI Solutions on Quranic Linguistic Knowledge