AI.info
Latest Research — Page 57
Browse Latest Research on AI.info.
- Content is What Remains: Invariant Speech Tokenization from Parallel Utterances
- Bi-View Embedding Fusion: A Hybrid Learning Approach for Knowledge Graph's Nodes Classification Addressing Problems with Limited Data
- ToolTok: Tool Tokenization for Efficient and Generalizable GUI Agents
- ExpSeek: Self-Triggered Experience Seeking for Web Agents
- TSExplorer: An interactive data annotation and exploration tool for time-series data
- M-GRPO: Stabilizing Self-Supervised Reinforcement Learning for Large Language Models with Momentum-Anchored Policy Optimization
- ContextPilot: Teaching Agents for Proactive Context Management via Fine-grained RL
- Quality-Aware Translation Tagging in Multilingual RAG system
- Rethinking Cross-Modal Fine-Tuning: Optimizing the Interaction Between Feature Alignment and Target Fitting
- A Parameter-Linear Formulation of the Optimal Path Following Problem for Robotic Manipulator
- PROVIA: Procedure State Tracking for Online Mistake Detection in Egocentric Videos
- Frequency Matters: When Time Series Foundation Models Fail Under Spectral Shift
- InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
- LRAgent: Efficient KV Cache Sharing for Multi-LoRA LLM Agents
- Few-Shot Precise Event Spotting via Unified Multi-Entity Graph and Distillation
- Le-DETR: Revisiting Real-Time Detection Transformer with Efficient Encoder Design
- CMI-MTL: Cross-Mamba interaction based multi-task learning for medical visual question answering
- Learning Sexism Detection Using Multi-Agent Perspectivist Preference Optimization
- TeachMaster: Generative Teaching via Code
- Restore Text First, Enhance Image Later: Two-Stage Scene Text Image Super-Resolution with Glyph Structure Guidance
- Reading Between the Lines: The One-Sided Conversation Problem
- Talk, Judge, Cooperate: Gossip-Driven Indirect Reciprocity in Self-Interested LLM Agents
- Value Under Ignorance in Universal Artificial Intelligence
- MC-DeTra: Motion-Consistent Joint Object Detection and Socially-Aware Trajectory Forecasting in Bird's-Eye-View Images
- Uncertainty Matters in Dynamic Gaussian Splatting for Monocular 4D Reconstruction
- Before You Say It: Anticipating Verbal Behavior from Longitudinal Everyday Conversations with LLMs
- Adequately Tailoring Age Verification Regulations
- Walking the Schrödinger Bridge: A Direct Trajectory for Text-to-3D Generation
- GEM: A Generative Embedding Model Bridging Reasoning and Retrieval
- FLARE: A Failure-Aware Framework for Autonomous Correction and Recovery in Visual-Language Robotic Manipulation
- EditInfinity: Image Editing with Binary-Quantized Generative Models
- It's a TRAP! Task-Redirecting Agent Persuasion Benchmark for Web Agents
- RankT2I: A Submodular Framework for Discovering Interpretable and Diverse Semantics in Text-to-Image Models
- ShieldedCode: Learning Robust Representations for Virtual Machine Protected Code
- OmniVL-Guard: Towards Unified Vision-Language Forgery Detection and Grounding via Balanced RL
- Modeling Cascaded Delay Feedback for Online Net Conversion Rate Prediction: Benchmark, Insights and Solutions
- EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
- In-Context Robot Learning with VLM Agents
- ArtSociety: Multi-Agent Multimodal Collaboration for Art Emotion Understanding
- Contextual Tokenization for Graph Inverted Indices