Ricerca
Distillazione ricorsiva dell’harness tra agenti per la manipolazione robotica
Un obiettivo centrale della robotica è consentire la manipolazione al variare dei compiti e degli ambienti. I modelli visione-linguaggio-azione (VLA) offrono ampie capacità di manipolazione, ma posson

- arXiv
- 2609.33378
- Pubblicato
- 2026-09-27
- Autori
- Seungyeon Kim, Junhoo Lee, Minkyu Kim, Baekseung Kim, Nojun Kwak
Abstract degli autori
Un obiettivo centrale della robotica è consentire la manipolazione al variare dei compiti e degli ambienti. I modelli visione-linguaggio-azione (VLA) offrono ampie capacità di manipolazione, ma possono incontrare difficoltà quando, durante l’esecuzione, occorre individuare le cause degli insuccessi e adattare il comportamento. Agenti più capaci possono scoprire interventi efficaci interagendo con questi modelli. Proponiamo Recursive Harness Distillation per accumulare questa esperienza sotto forma di indicazioni riutilizzabili da più agenti. Un agente più capace condensa la propria esperienza in un manuale operativo per un agente leggero, poi lo perfeziona ricorsivamente sulla base dei riscontri ottenuti durante l’esecuzione da parte dell’agente leggero. Il manuale operativo così ottenuto consente agli agenti di riutilizzare le conoscenze accumulate sugli interventi in nuove istanze di compiti, senza aggiornare i parametri del modello. Nella manipolazione nel mondo reale, l’harness porta il tasso di successo dal 37,3% al 64,0%. Su SimplerEnv Bridge, l’agente leggero con il manuale operativo raggiunge un tasso di successo del 66,7%, contro il 41,7% della baseline basata esclusivamente su GR00T, e supera l’agente più capace privo del manuale operativo. Lo stesso manuale operativo giova anche all’agente più capace, che raggiunge un tasso di successo del 79,2%. Questi risultati dimostrano la fattibilità della distillazione dell’harness nella robotica: l’esperienza maturata negli interventi può essere accumulata, perfezionata attraverso l’esecuzione e riutilizzata da più agenti per migliorare la manipolazione.
Il riassunto di questo paper è disponibile solo in inglese: leggilo nella pagina inglese.
Leggi il paper originale su arXiv