AI.info
Latest Research — Page 10
Sfoglia Ricerca recente su AI.info.
In inglese
- CERA-MoA: meccanismi di instradamento che coevolvono con agenti LLM in apprendimento continuo
- Accusarsi da una parte all’altra dell’aula: contrapposizione politica e attribuzione delle colpe nel Parlamento danese
- Verso un ragionamento efficiente: apprendere scorciatoie causali per i modelli linguistici a diffusione
- Accoppiamento geometrico e semantico per la comprensione delle interazioni nelle scene 3D
- Benchmark Radar: una banca dati in costante aggiornamento e un motore di ricerca per i benchmark e la valutazione dell’IA
- DataFlex-RL: una piattaforma di valutazione per le politiche dei dati nell’RLVR
- Pelican-Sim 1.0: un simulatore generale basato su un modello del mondo per l’intelligenza incarnata
- World Action Agent: sfruttare i VLM per la manipolazione robotica tramite World Action Rehearsal
- PonderPounce: un MLLM preaddestrato come motore del contesto dell’episodio per il controllo robotico
- Ottimizzazione della policy con clipping adattivo per gruppo
- Agora: Git come memoria condivisa per l’AutoResearch collettiva
- Addestrare gli agenti a evolvere insieme al proprio Harness: rapporto tecnico su TaoLive Digital Avatar Agent
- SolarWM: dati aperti e addestramento scalabile per modelli del mondo video a lungo orizzonte
- UltraTex: sbloccare la diffusione multi-view a 2K per la texturizzazione 3D
- VISTA: un’architettura di apprendimento per rinforzo multi-agente basata sull’attenzione per l’assegnazione dei compiti ai sensori nell’ambito della consapevolezza situazionale spaziale
- TempCloze: i Video-LLM sanno individuare la parte centrale mancante?
- Tutte le modalità sono uguali, ma il video è più uguale: colmare il divario di cross-attention nella generazione congiunta di video
- Realtime-Venus: un sistema di interazione full-duplex con delega asincrona
- Migliorare i filtri d’ensemble con il flow matching
- Lucida: analizzare, generare e posizionare per modellare scene componibili dal reale alla simulazione
- Super Library Agent: generazione e manutenzione congiunte di più applicazioni oltre la singola base di codice
- RewardVerse: ottimizzazione delle policy guidata da rubriche per la modellazione delle ricompense video
- Perché Gated DeltaNet resiste alla quantizzazione a 4 bit: NVFP4 W4A4 per la metà ricorrente di un LLM ibrido da 27B
- Oltre il recupero: evoluzione progressiva della memoria latente per la comprensione dei video in streaming
- SHAPE della catena di pensiero nel ragionamento matematico
- Autoregressive Mosaics: un’indagine sul ragionamento spaziale bidimensionale nei modelli linguistici solo testuali
- Trasferire l’intelligenza dei VLM al controllo robotico
- Fin dove possono arrivare i dati sintetici nell’OCR del thailandese?
- Motion-Omni: voce e movimento di tutto il corpo generati congiuntamente end-to-end per il dialogo parlato
- La calibrazione come criterio fondamentale nella valutazione degli LLM
- DeltaWAM: modelli world-action per la manipolazione bimanuale
- Sintesi di dati sui cambiamenti guidata da conoscenze del mondo reale per il telerilevamento
- L’agente come politica di controllo per la manipolazione robotica
- L’ipotesi della rappresentazione lineare richiede un’azione di gruppo
- Mira-Scene: layout allineati ai pixel per la ricostruzione generativa di scene 3D
- Memoria just-in-time: imparare a selezionare memorie adattive al compito per agenti LLM
- StepAudio 3 Music: rapporto tecnico
- Imparare a risolvere problemi difficili con l’RL per gli LLM senza arrendersi mai
- Mind2Dialogue: addestrare modelli linguistici attenti alle persone simulando gli stati mentali degli utenti
- Iperreti di circuiti per modelli linguistici a diffusione potenziati dal calcolo quantistico