AI.info
Latest Research — Page 3
Sfoglia Ricerca recente su AI.info.
In inglese
- Più modelli, più problemi: come selezionare al meglio i pool di modelli nella progettazione di sistemi multi-agente
- Lean Pool: un archivio di matematica formalizzata mantenuto dall’IA
- OmniEdu: modelli fondazionali aperti per l’apprendimento e l’insegnamento
- MultiVENT-Raw: un benchmark per il recupero e il ragionamento su video grezzi
- HuRo: robotizzare i video di persone per un pretraining VLA scalabile
- TrackEverything: tracciamento denso su lunghi orizzonti mediante deduplicazione delle rappresentazioni 3D della scena
- IterSynth: ripensare gli agenti di ricerca approfondita con la sintesi iterativa e la separazione dei ruoli
- PROVIA: tracciamento dello stato delle procedure per rilevare online gli errori nei video egocentrici
- SAGE: mitigare i bias del ragionamento a lungo orizzonte tramite una guida topologica
- Un quadro basato su interventi sui dati per verificare privacy ed equità nell’imaging medico generativo
- Mappa decisionale universale frattale in linguaggio naturale: triage edge in tempo reale in domini eterogenei
- Gricea: una piattaforma di scienza aperta per la ricerca sull’IA conversazionale
- Quanto vale un diritto umano? ECtHR-NPD: un benchmark per prevedere i risarcimenti per danno non patrimoniale
- SpeakerMem-R1: memoria a doppio binario incentrata sui parlanti per il dialogo tra più partecipanti
- WanPE: verso un miglioramento cinematografico dei prompt per la moderna generazione di video da testo
- GeoPair: fattorizzazione interstrato che preserva la geometria per la compressione dei transformer senza addestramento
- I team di agenti auto-organizzati imparano a ragionare insieme
- L’illusione dell’allineamento nei grandi modelli linguistici multimodali
- Ottimizzazione della politica di Bellman
- Un test della macchina della verità per i modelli linguistici: leggere le conoscenze che un modello non rivela
- Imparare a scoprire matematica interessante
- L’agente di buon gusto: misurare e migliorare il gusto nei compiti a lungo termine
- Blindspot: un benchmark per la calibrazione della sicurezza e dei rifiuti negli agenti che usano strumenti su orizzonti lunghi
- WorldCrafter: modello video del mondo coerente con memoria implicita consapevole del 3D
- Ordinamento equo dei feed per il bilancio partecipativo
- Uno studio empirico sulla progettazione degli harness per agenti di coding
- Qwen-Planner-Agent: un framework di IA per l’IA a ciclo chiuso per agenti di pianificazione mobile nel mondo reale
- Smussamento e validazione basati sulle previsioni per la valutazione disaggregata dell’IA
- Accusarsi da una parte all’altra dell’aula: contrapposizione politica e attribuzione delle colpe nel Parlamento danese
- Verso un ragionamento efficiente: apprendere scorciatoie causali per i modelli linguistici a diffusione
- Accoppiamento geometrico e semantico per la comprensione delle interazioni nelle scene 3D
- World Action Agent: sfruttare i VLM per la manipolazione robotica tramite World Action Rehearsal
- UltraTex: sbloccare la diffusione multi-view a 2K per la texturizzazione 3D
- VISTA: un’architettura di apprendimento per rinforzo multi-agente basata sull’attenzione per l’assegnazione dei compiti ai sensori nell’ambito della consapevolezza situazionale spaziale
- Tutte le modalità sono uguali, ma il video è più uguale: colmare il divario di cross-attention nella generazione congiunta di video
- Realtime-Venus: un sistema di interazione full-duplex con delega asincrona
- Migliorare i filtri d’ensemble con il flow matching
- RewardVerse: ottimizzazione delle policy guidata da rubriche per la modellazione delle ricompense video
- Trasferire l’intelligenza dei VLM al controllo robotico
- La calibrazione come criterio fondamentale nella valutazione degli LLM