AI.info
Latest Research — Page 4
Sfoglia Ricerca recente su AI.info.
In inglese
- DeltaWAM: modelli world-action per la manipolazione bimanuale
- L’ipotesi della rappresentazione lineare richiede un’azione di gruppo
- Mira-Scene: layout allineati ai pixel per la ricostruzione generativa di scene 3D
- Memoria just-in-time: imparare a selezionare memorie adattive al compito per agenti LLM
- Iperreti di circuiti per modelli linguistici a diffusione potenziati dal calcolo quantistico
- Collusione emergente nelle interazioni a lungo orizzonte tra agenti LLM
- Sulla diffusibilità dei latenti ad alta dimensionalità
- APort Vault: benchmark sull’autorizzazione dei pagamenti degli agenti di IA che usano strumenti con l’Open Agent Passport
- Grounded Action Model: il grounding 3D come fondamento per la robotica
- Dai riconoscitori di pattern ai compagni personalizzati: una rassegna sui modelli linguistici di grandi dimensioni nella salute mentale
- Direct Message Approximation (DMA): un framework basato sulla consistenza per un’inferenza approssimata trattabile sui grafi fattoriali
- CADWorld: benchmark per l’uso del computer nella progettazione assistita da computer a lungo orizzonte
- TeleAntiFraud 2.0: un benchmark aggiornabile, basato sui profili e sull’audio per rilevare le frodi telefoniche
- ExplorationBench: misurare l’esplorazione dei sistemi di IA in mondi alieni verificabili
- Riconoscimento multilingue unificato del testo nelle scene con Mixture-of-Experts che tiene conto del sistema di scrittura
- GTA: Graph Theory Agent e benchmark per il ragionamento algoritmico sui grafi con gli LLM
- Editing video in streaming con un adattamento semplice
- TriWorldBench: una prospettiva di coerenza tra tre visuali sui modelli del mondo embodied
- TAPe+ML: una rappresentazione strutturata compatta per la visione artificiale multi-task
- Apprendimento contrastivo per la verifica dell’autorialità
- Potatura robotica visuomotoria nei frutteti planari mediante apprendimento per rinforzo ibrido
- EdgeGen: migliorare gli agenti che usano strumenti oltre i percorsi senza intoppi, generando casi limite sintetici
- Paint-Anything: controllo unificato di qualsiasi colore per la generazione e la modifica delle immagini
- Astronex-World 1.0: modello fondazionale del mondo interattivo in tempo reale
- WhatWorkedBench: valutare la comprensione sperimentale negli agenti di IA
- SemMSA: analisi robusta del sentiment multimodale con dati incompleti, assistita dalla semantica latente
- Spatial-Interactor: apprendere il ragionamento spaziale attraverso l’interazione con il mondo fisico osservabile
- ACLArena: apprendimento continuo degli agenti nel post-training multistadio
- Sei livelli in meno: potatura dell’encoder per Whisper con recupero senza etichette
- SocioVerse2: un framework di simulazione sociale dinamica longitudinale basato su un paradigma di coevoluzione tra esseri umani e IA
- Prima dell’arresto: benchmarking degli LLM sulla profilazione criminale basata su prove incomplete
- Tradurre il traduttore: scomporre il costo della comunicazione tra agenti imposta in inglese
- Costo totale dell’agentività: attribuzione esatta del costo dell’iniezione della memoria nei flussi di lavoro con più agenti basati su LLM
- Rapporto tecnico su Hunyuan-A13B
- PosteriorBench: dalle stime puntuali al confronto delle distribuzioni a posteriori nella valutazione dei solver inversi generativi
- OmniEcho: comprensione audio-visiva dello spazio per agenti incarnati omnmodali
- Il raffinamento è intrinsecamente modificabile: editing delle immagini da prompt a prompt senza addestramento con Generative Refinement Network
- Quantizzazione post-training di Cellpose-SAM con vincoli di mantenimento delle prestazioni per la microscopia delle cellule staminali
- MemoryAthena: instradamento adattivo tra memorie latenti e generate
- Uranus: costruire l’infrastruttura di simulazione di nuova generazione per l’IA incarnata