AI.info
Latest Research — Page 63
Browse Latest Research on AI.info.
- HalluClean: A Unified Framework to Combat Hallucinations in LLMs
- M$^2$-Miner: Multi-Agent Enhanced MCTS for Mobile GUI Agent Data Mining
- RASA: Disentangled Spatial-Motional Priors for Cross-Identity Character Animation
- Omni-View: Unlocking How Generation Facilitates Understanding in Unified 3D Model based on Multiview images
- AssetFormer: Modular 3D Assets Generation with Autoregressive Transformer
- AgentChangeBench: A Multi-Dimensional Evaluation Framework for Goal-Shift Robustness in Conversational AI
- CubeComposer: Spatio-Temporal Autoregressive 4K 360° Video Generation from Perspective Video
- Sign-Based Optimizers Are Effective Under Heavy-Tailed Noise
- Block-Sample MAC-Bayes Generalization Bounds
- BiGain: Unified Token Compression for Joint Generation and Classification
- T1: One-to-One Channel-Head Binding for Multivariate Time-Series Imputation
- Compositional Symmetry as Compression: Lie Pseudogroup Structure in Algorithmic Agents
- Do LLMs Feel? Teaching Emotion Recognition with Prompts, Retrieval, and Curriculum Learning
- FoundationMotion: Auto-Labeling and Reasoning about Spatial Movement in Videos
- Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
- LoCoT2V-Bench: Benchmarking Long-Form and Complex Text-to-Video Generation
- Antidistillation Fingerprinting
- Continuous Improvement and Parallel Autonomous Exploration: An LLM-Agent Framework for Searching Large Solution Spaces
- Small Object Detection for Birds with Swin Transformer
- KnowVal: A Knowledge-Augmented and Value-Guided Autonomous Driving System
- TOPSIS-like metaheuristic for LABS problem
- Skyra: AI-Generated Video Detection via Grounded Artifact Reasoning
- HoopMind: A Real-Time Neural Game-Tree System for Opponent-Aware Possession Planning
- C-arm Guidance: A Self-supervised Approach To Automated Positioning During Stroke Thrombectomy
- RISE-Video: Can Video Generators Decode Implicit World Rules?
- d3LLM: Ultra-Fast Diffusion LLM using Pseudo-Trajectory Distillation
- IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
- Retrieved but not ranked: surface-form bias in structural retrieval, from mathematics to agent trajectories
- MATA: Multi-Agent Framework for Reliable and Flexible Table Question Answering
- SlowFocus: Enhancing Fine-grained Temporal Understanding in Video LLM
- CADKnitter: Compositional CAD Generation from Text and Geometry Guidance
- Unified Biomolecular Trajectory Generation via Pretrained Variational Bridge
- Generative Visual Code Mobile World Models
- DynamiX: Dynamic Resource eXploration for Personalized Ad-Recommendations
- DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research
- Yo'City: Personalized and Boundless 3D Realistic City Scene Generation via Self-Critic Expansion
- Are We There Yet? Assessing Computer-Use Agents for Blind Users' Accessible Interaction with Desktop Applications
- E-RGB-D: Real-Time Event-Based Perception with Structured Light
- MISA: Memory-Efficient LLMs Optimization with Module-wise Importance Sampling
- Beyond Observations: Reconstruction Error-Guided Irregularly Sampled Time Series Representation Learning