AI.info
Latest Research — Page 20
Browse Latest Research on AI.info.
- Thunder-KoNUBench: A Corpus-Aligned Benchmark for Korean Negation Understanding
- Collective Narrative Grounding: Community-Coordinated Data Contributions to Improve Local AI Systems
- CyIN: Cyclic Informative Latent Space for Bridging Complete and Incomplete Multimodal Learning
- Test-Time Mixture of World Models for Embodied Agents in Dynamic Environments
- Learning Multimodal Embeddings for Traffic Accident Prediction and Causal Estimation
- Multi-Step Tool-Calling over Korean Open Public APIs: A Benchmark and a Data-Synthesis Recipe
- VLM-CAD: VLM-Optimized Collaborative Agent Design Workflow for Analog Circuit Sizing
- CForce: Boosting Parallel Decoding for dLLMs via Consistency Forcing
- Global Sensitivity Analysis for Engineering Design Based on Individual Conditional Expectations
- Socio-cognitive agent-oriented evolutionary algorithm with trust-based optimization
- MoralityGym: A Benchmark for Evaluating Hierarchical Moral Alignment in Sequential Decision-Making Agents
- TTOM: Test-Time Optimization and Memorization for Compositional Video Generation
- CPiRi: Channel Permutation-Invariant Relational Interaction for Multivariate Time Series Forecasting
- Concept-RuleNet: Grounded Multi-Agent Neurosymbolic Reasoning in Vision Language Models
- Reward Modeling from Natural Language Human Feedback
- PocketLLM: Ultimate Compression of Large Language Models via Meta Networks
- Rethinking Expert Trajectory Utilization in LLM Post-training for Mathematical Reasoning
- The Map of Misbelief: Tracing Intrinsic and Extrinsic Hallucinations Through Attention Patterns
- LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
- EfficientNav: Towards On-Device Object-Goal Navigation with Navigation Map Caching and Retrieval
- A Knowledge-Based Language Model: Deducing Grammatical Knowledge in a Multi-Agent Language Acquisition Simulation
- Car Drag Coefficient Prediction from 3D Point Clouds Using a Slice-Based Surrogate Model
- TopoBench: Benchmarking LLMs on Hard Topological Reasoning
- Lark: Biologically Inspired Neuroevolution for Multi-Stakeholder LLM Agents
- Meta$^n$: Recursive Self-Improvement through Emergent Depth
- RAST-MoE-RL: A Regime-Aware Spatio-Temporal MoE Framework for Deep Reinforcement Learning in Ride-Hailing
- MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
- DeepSearchQA: Bridging the Comprehensiveness Gap for Deep Research Agents
- MOON2.0: Dynamic Modality-balanced Multimodal Representation Learning for E-commerce Product Understanding
- Offline Reinforcement Learning with Generative Trajectory Policies
- Emergence of Linear Truth Encodings in Language Models
- Image Diffusion Preview with Consistency Solver
- MUSE: Multi-Tenant Model Serving With Seamless Model Updates
- HeurekaBench: A Benchmarking Framework for AI Co-scientist
- Repetition as Reinforcement: Enhancing Sample Efficiency via Instant Episode Repetition in Reinforcement Learning
- To Retrieve or To Think? Cross-Boundary Context Evolution for Multi-hop Complex Reasoning
- Modal Aphasia: Can Unified Multimodal Models Describe Images From Memory?
- Refine and Align: Confidence Calibration through Multi-Agent Interaction in VQA
- AutoHood3D: A Multi-Modal Benchmark for Automotive Hood Design and Fluid-Structure Interaction
- Verified Critical Step Optimization for LLM Agents