AI.info
Latest Research — Page 73
Browse Latest Research on AI.info.
- CausalSpatial: A Benchmark for Object-Centric Causal Spatial Reasoning
- Test-Time Detoxification without Training or Learning Anything
- Speak for Me: Giving LLMs the Situational Awareness to Participate in a Meeting
- On the Fragility of Self-Improving Agents: Variance, Task Order, and Underspecification
- TouchFormer: A Robust Transformer-based Framework for Multimodal Material Perception
- CLINB: A Climate Intelligence Benchmark for Foundational Models
- Divide, then Ground: Adapting Frame Selection to Query Types for Long-Form Video Understanding
- ATLAS: Scaffold-Free Algorithm Synthesis by LLMs via Embedding-Guided Quality-Diversity Search
- GazeInterpreter: Parsing Eye Gaze to Generate Eye-Body-Coordinated Narrations
- HGeo-TopoMap: Boosting Topological Mapping with Hierarchical Geometric Priors
- DiVE-k: Differential Visual Reasoning for Fine-grained Image Recognition
- Adaptive Rollout Allocation for Online Reinforcement Learning with Verifiable Rewards
- PI-Light: Physics-Inspired Diffusion for Full-Image Relighting
- Cloud4D: Estimating Cloud Properties at a High Spatial and Temporal Resolution
- The Autonomous Agency Scale: A Behavioral Framework for Measuring Self-Directed Behavior in AI Systems
- LookBack: Where and How to Score LVLM Responses via Visual Reference Usage
- Optimizing Multimodal LLMs for Egocentric Video Understanding: A Solution for the HD-EPIC VQA Challenge
- Creating Blank Canvas Against AI-enabled Image Forgery
- Exo-Plore: Exploring Exoskeleton Control Space through Human-aligned Simulation
- Explaining AI Without Code: A User Study on Explainable AI
- Beyond End-to-End Video Models: An LLM-Based Multi-Agent System for Educational Video Generation
- Test-time Diverse Reasoning by Riemannian Activation Steering
- LingGym: How Far Are LLMs from Thinking Like Field Linguists?
- Diagnosing Structural Failures in LLM-Based Evidence Extraction for Meta-Analysis
- Detecting Misbehaviors of Large Vision-Language Models by Evidential Uncertainty Quantification
- How Far Can Unsupervised RLVR Scale LLM Training?
- $R^3$: Training Robots to Reason in Natural Language via Reinforcement Learning
- Rethinking Driving World Model as Synthetic Data Generator for Perception Tasks
- DraCo: Draft as CoT for Text-to-Image Preview and Rare Concept Generation
- Preserving Source Video Realism: High-Fidelity Face Swapping for Cinematic Quality
- Adaptive Parameter Optimization for Robust Remote Photoplethysmography
- DRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning
- Implementing Knowledge Representation and Reasoning with Object Oriented Design
- RF-MatID: Dataset and Benchmark for Radio Frequency Material Identification
- Distilled Decoding 2: One-step Sampling of Image Auto-regressive Models with Conditional Score Distillation
- EDU-CIRCUIT-HW: Evaluating Multimodal Large Language Models on Real-World University-Level STEM Student Handwritten Solutions
- Particulate: Feed-Forward 3D Object Articulation
- Fast and Robust Simulation-Based Inference With Optimization Monte Carlo
- Context Matters: Peer-Aware Student Behavioral Engagement Measurement via VLM Action Parsing and LLM Sequence Classification
- MiMo-Embodied: X-Embodied Foundation Model Technical Report