Vai al contenuto
AI.info

Ricerca

L’agente come politica di controllo per la manipolazione robotica

Dimostriamo che un agente generalista può controllare direttamente un robot fisico per l’intera esecuzione di un compito, senza alcun addestramento specifico per il compito o per l’ambiente. Introduci

L’agente come politica di controllo per la manipolazione robotica
arXiv
2609.12541
Pubblicato
2026-09-11
Autori
Mengzhao Jia, Yang Lin, Xixin Zhang, Zhihan Zhang, Xiaobai Liu, Meng Jiang

Abstract degli autori

Dimostriamo che un agente generalista può controllare direttamente un robot fisico per l’intera esecuzione di un compito, senza alcun addestramento specifico per il compito o per l’ambiente. Introduciamo Agent as Policy (AGP), che affida all’agente la pianificazione e l’esecuzione del compito. Dati un compito e un’interfaccia robotica, l’agente interpreta le informazioni visive, scrive programmi eseguibili, impartisce comandi di movimento e modifica le proprie azioni in risposta agli esiti fisici. Le capacità di ragionamento e programmazione dell’agente entrano così in interazione continua con il mondo fisico. Studiamo AGP in diversi compiti di manipolazione nel mondo reale, che comprendono manipolazioni di precisione, movimenti dinamici e oggetti deformabili. Tra questi figurano l’assemblaggio a partire da video di persone, la costruzione con blocchi a partire da immagini dell’obiettivo, il ribaltamento di dadi, il lancio mirato e la piegatura di asciugamani con due mani. Nell’assemblaggio, nella costruzione con blocchi e nel ribaltamento di dadi, AGP riesce in almeno otto prove su dieci per ogni configurazione del compito valutata. Studiamo inoltre l’efficienza attraverso l’accumulo di esperienza nei compiti e riscontriamo che riutilizzare procedure e programmi salvati riduce i tempi di esecuzione nelle prove ripetute. Questi risultati indicano una strada per impiegare agenti generalisti come politiche di controllo per robot, estendendone l’autonomia alla manipolazione fisica attraverso il ragionamento durante l’esecuzione, la programmazione e l’interazione.

Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.

Leggi il paper originale su arXiv