AI.info
Latest Research — Page 45
Browse Latest Research on AI.info.
- CDFlow: Building Invertible Layers with Circulant and Diagonal Matrices
- Control-Data Flow Separation: Stable Prompt Optimization in Multi-Agent LLMs
- ChartE$^{3}$: A Comprehensive Benchmark for End-to-End Chart Editing
- Inter-X++: A Comprehensive Benchmark for Multimodal Human-Human Interaction Analysis
- Bridging the gap to real-world language-grounded visual concept learning
- Edit Knowledge, Not Just Facts via Multi-Step Reasoning over Background Stories
- Imitation Learning for Connection-Tableau Construction
- Test-Time Augmentation for LLMs: When Input Diversity Beats Output Diversity at Matched Compute
- Uncertainty Quantification for Reduced-Order Surrogate Models Applied to Cloud Microphysics
- Visual Framing for News Stance Detection via Image Generation
- Adaptive Momentum and Nonlinear Damping for Neural Network Training
- More Than Generation: Unifying Generation and Depth Estimation via Text-to-Image Diffusion Models
- Fluent Alignment with Disfluent Judges: Post-training for Lower-resource Languages
- CASL: Curvature-Augmented Self-supervised Learning for 3D Anomaly Detection
- CHUCKLE -- When Humans Teach AI To Learn Emotions The Easy Way
- Improving the Trade-off Between Watermark Strength and Speculative Sampling Efficiency for Language Models
- Open Ad-hoc Categorization with Contextualized Feature Learning
- Knowledge-Informed Kernel State Reconstruction from Heterogeneous Partial Observations
- Graph Learning on Ensembles of Cyclic Peptides: An Investigation of Molecular Ensemble Modeling
- SolverLLM: Leveraging Test-Time Scaling for Optimization Problem via LLM-Guided Search
- LearnAD: Learning Interpretable Rules for Brain Networks in Alzheimer's Disease Classification
- Learning an Image Editing Model without Image Editing Pairs
- TOFA: Training-Free One-Shot Federated Adaptation for Vision-Language Models
- SEBA: Sample-Efficient Black-Box Attacks on Visual Reinforcement Learning
- Minimizing the Effect of Sleep Deprivation in the Forward-Forward Algorithm
- Vision Language Models for Dynamic Human Activity Recognition in Healthcare Settings
- ORCA-bench: How Ready Are Language Model Agents for Oncall?
- VIBE: A VAD-Informed Benchmark for Entity-Centered Affective Profiling of Large Language Model Outputs
- PanoAffordanceNet: Towards Holistic Affordance Grounding in 360° Indoor Environments
- Node-Based Editing for Multimodal Generation of Text, Audio, Image, and Video
- A Multi-Vehicle Dataset with Camera, LiDAR, and Radar Sensors and Scanned 3D Models for Custom Auto-Annotation using RTK-GNSS
- LongVPO: From Anchored Cues to Self-Reasoning for Long-Form Video Preference Optimization
- COMPASS: Enhancing Agent Long-Horizon Reasoning with Evolving Context
- All Required, In Order: Phase-Level Evaluation for AI-Human Dialogue in Healthcare and Beyond
- Time-to-Move: Training-Free Motion Controlled Video Generation via Dual-Clock Denoising
- Tears or Cheers? Benchmarking LLMs via Culturally Elicited Distinct Affective Responses
- FixAnything: 3D-Consistent Rendering Refinement via Video Generative Priors
- HeaPA: Difficulty-Aware Heap Sampling and On-Policy Query Augmentation for LLM Reinforcement Learning
- Low-Resolution Editing is All You Need for High-Resolution Editing
- OctWorld: Long-Range World-Consistent Video Generation with Octree-Based 3D Mapping