AI.info
Latest Research — Page 12
Sfoglia Ricerca recente su AI.info.
In inglese
- SpectralShift: estensione efficace della finestra di contesto di Gated DeltaNet tramite riparametrizzazione spettrale
- TriWorldBench: una prospettiva di coerenza tra tre visuali sui modelli del mondo embodied
- Comprensione omni incentrata sul parlato senza addestramento con VLM congelati
- I punteggi da soli non dimostrano una scoperta: il Discovery Certification Protocol per verificare gli agenti di ricerca basati sull’IA
- TAPe+ML: una rappresentazione strutturata compatta per la visione artificiale multi-task
- Dalla riponderazione alla riscrittura: sfruttare gli effetti degli interventi sugli esempi influenti nell’attribuzione dei dati di addestramento
- La meccanica del predominio democratico: un paradigma di dinamica dei sistemi per l’ingegneria dinamica del consenso
- Apprendimento contrastivo per la verifica dell’autorialità
- L’altra metà del muro della memoria: servire MoE da 35B da SSD con una predizione dell’instradamento addestrata
- StochBench: un benchmark specifico per i processi stocastici in Lean
- EmbodiedSkills: un framework unificato per orchestrare, addestrare e distribuire agenti VLA
- TTPO: ottimizzazione della policy in fase di test
- RoboTok: un motore di dati su scala Internet per la ricerca di dimostrazioni umane e l’apprendimento della manipolazione con destrezza
- Potatura robotica visuomotoria nei frutteti planari mediante apprendimento per rinforzo ibrido
- Adaptive Bridge: un livello di disaccoppiamento basato su proxy per mitigare la backpressure DDS in ROS 2
- EdgeGen: migliorare gli agenti che usano strumenti oltre i percorsi senza intoppi, generando casi limite sintetici
- Paint-Anything: controllo unificato di qualsiasi colore per la generazione e la modifica delle immagini
- Astronex-World 1.0: modello fondazionale del mondo interattivo in tempo reale
- Sfruttare CLIP e DINO: una rete di fusione a cascata che tiene conto dell’incertezza per rilevare immagini deepfake anche in contesti nuovi
- World in World: esplorare il mondo con i modelli del mondo
- WhatWorkedBench: valutare la comprensione sperimentale negli agenti di IA
- Iterazione generalizzata degli agenti: un unico quadro formale per il miglioramento iterativo delle politiche e l’auto-miglioramento ricorsivo
- DICS: esplorare la coerenza intrinseca dei dati per la selezione delle istruzioni visive
- Imparare a valutare prima di migliorare: induzione automatica di griglie di valutazione per agenti di ricerca automatizzati
- MInTRL: l’intervento off-policy può potenziare l’apprendimento per rinforzo on-policy
- AgentJudgeBench: un benchmark a più livelli di difficoltà per valutare i giudici LLM nelle chiamate agli strumenti da parte degli agenti
- SemMSA: analisi robusta del sentiment multimodale con dati incompleti, assistita dalla semantica latente
- FlowBalance: auto-miglioramento fondato sul verificatore a partire dall’esperienza di ragionamento on-policy
- BeaconKV: compressione della cache key-value guidata da query faro per un’inferenza efficiente dei modelli di ragionamento di grandi dimensioni
- Sapere a cosa non rispondere: la mancata ottemperanza selettiva nei modelli visivo-linguistici
- $Φ$-Bench: i modelli linguistici di grandi dimensioni possono sviluppare l’infrastruttura che li alimenta?
- Spatial-Interactor: apprendere il ragionamento spaziale attraverso l’interazione con il mondo fisico osservabile
- Scomporre per direzione l’evoluzione delle rappresentazioni nei transformer
- FlashRender: rendering generativo in pochi passaggi tramite MeanFlow per video con controllo della camera
- ACLArena: apprendimento continuo degli agenti nel post-training multistadio
- MobileVLA-R1 2.0: ragionamento potenziato dall’apprendimento per rinforzo per il controllo dei robot mobili
- WorldSculpt: generare mondi composizionali da video ancorati
- ZimaBlue: modelli di azione del mondo generalizzabili attraverso un pre-addestramento video scalabile
- Sei livelli in meno: potatura dell’encoder per Whisper con recupero senza etichette
- Ripensare la distillazione on-policy dei modelli linguistici di grandi dimensioni II: un solo esempio di addestramento