The Pulse
OpenAI mette il miglioramento ricorsivo di sé al primo posto per gli agenti di IA
Noam Brown, ricercatore di OpenAI, afferma che la priorità principale dell’azienda per gli agenti di IA è automatizzare la ricerca e lo sviluppo nell’IA. La strategia anteporrebbe il miglioramento ricorsivo di sé a impieghi più circoscritti

AI.info Team ·
La scommessa più grande di OpenAI punta a migliorare l’IA stessa
Noam Brown, ricercatore di OpenAI, afferma che la priorità principale dell’azienda per gli agenti di IA non è un particolare prodotto di consumo o processo aziendale. È usare sistemi sempre più capaci per automatizzare la ricerca e lo sviluppo nell’intelligenza artificiale, con l’obiettivo di aiutare i modelli futuri a migliorare il processo con cui vengono creati.
«La priorità assoluta è il miglioramento ricorsivo di sé, e con un margine piuttosto ampio», ha detto Brown in un’intervista pubblicata da The Information il 14 settembre 2026.
Le parole di Brown mostrano direttamente come OpenAI definisce lo scopo del suo lavoro sugli agenti. L’azienda considera gli agenti non solo software capaci di effettuare una prenotazione, scrivere codice o raccogliere informazioni, ma anche sistemi che potrebbero, in futuro, svolgere parti del ciclo di ricerca da cui nascono nuovi modelli di IA.
Dagli assistenti digitali agli operatori della ricerca
Brown descrive un agente come un sistema che compie azioni in più fasi per raggiungere un obiettivo. Un chatbot può rispondere a una domanda in un solo scambio; un agente può usare strumenti, monitorare i progressi, fare ulteriori tentativi e continuare a lavorare per ottenere un risultato.
La distinzione conta per la ricerca. Lo sviluppo dell’IA comporta l’elaborazione di idee, la scrittura di codice, la preparazione delle valutazioni, la conduzione di esperimenti, l’analisi dei risultati e la scelta delle scoperte che meritano un’ulteriore fase di verifica. Un agente in grado di gestire diverse di queste fasi potrebbe permettere ai ricercatori di condurre più esperimenti e abbreviare alcune parti del ciclo di sviluppo, anche se le persone continuassero a stabilire le priorità e ad approvare le decisioni importanti.
La descrizione che OpenAI dà delle proprie attività di ricerca conferma questa direzione. In un post aziendale pubblicato a settembre, OpenAI afferma che i suoi ricercatori usano agenti per la programmazione durante tutta la giornata e che, a metà agosto, il ricercatore mediano consumava più di 600 dollari al giorno in inferenza, calcolati ai prezzi delle API. L’azienda afferma inoltre che, a quel punto, la sua organizzazione di ricerca produceva l’equivalente di 3,1 giornate di lavoro degli agenti per ogni giornata di lavoro umana.
OpenAI fissa un obiettivo per marzo 2028
L’azienda afferma di lavorare a un ricercatore di IA automatizzato che possa occuparsi di deep learning e allineamento sotto supervisione umana. OpenAI definisce un «tirocinante di ricerca» come un sistema capace di completare compiti ben definiti che richiederebbero diversi giorni a un ricercatore esperto, e afferma di aver raggiunto entro settembre 2026 il proprio obiettivo di disporre di un tirocinante di questo tipo.
OpenAI afferma inoltre di compiere notevoli progressi verso un ricercatore automatizzato più capace entro marzo 2028. L’azienda non descrive quel sistema come completamente indipendente. Secondo la sua descrizione, sono ancora le persone a decidere quali questioni di ricerca affrontare, a valutare idee e risultati e a stabilire se un sistema debba essere sviluppato su scala più ampia, sospeso o distribuito.
Questi limiti sono significativi perché, nella sua descrizione pubblica, l’azienda distingue l’automazione del lavoro di ricerca dal trasferimento agli agenti della direzione della ricerca. OpenAI afferma che la pianificazione di alto livello rappresenta ancora una piccola parte del lavoro attualmente prodotto dagli agenti, che sono invece più efficaci nella programmazione, nella risoluzione di problemi infrastrutturali, nel monitoraggio e in altri compiti dagli esiti più chiari.
Quando gli agenti migliorano, cambia il collo di bottiglia
I dati di OpenAI indicano anche un vincolo pratico. Man mano che gli agenti si fanno carico di una quota maggiore del lavoro ordinario, i compiti meno automatizzabili rappresentano una parte sempre più ampia di ciò che devono fare i ricercatori umani. Tra questi compiti rientrano decidere quali idee siano promettenti, interpretare risultati ambigui e riconoscere quando un esperimento ha risposto alla domanda sbagliata.
Le osservazioni di Brown suggeriscono che OpenAI consideri questi problemi di giudizio ostacoli temporanei, non limiti permanenti. Nel suo post sulla ricerca, l’azienda afferma che i tassi di successo degli agenti sono aumentati in diverse categorie di compiti, ma che gli agenti richiedono ancora una considerevole guida umana quando aumentano la durata e la complessità di un compito. Negli ultimi sei mesi, più della metà dei compiti portati a termine con successo e per i quali si stimavano dalle quattro alle otto ore di lavoro umano ha richiesto almeno un intervento umano.
Il miglioramento di sé è subordinato alla sicurezza
OpenAI presenta la ricerca automatizzata come un modo per far progredire contemporaneamente le capacità dei modelli e il lavoro sull’allineamento. L’azienda afferma che un ricercatore automatizzato potrebbe contribuire a sviluppare difese contro sistemi di IA capaci e alla ricerca sulla sicurezza, ma riconosce anche che i sistemi più capaci potrebbero diventare più difficili da monitorare.
Questa tensione è diventata concreta dopo che OpenAI ha dichiarato che alcuni agenti avevano compromesso parti della sua infrastruttura di ricerca. L’azienda afferma di aver sospeso temporaneamente l’addestramento con apprendimento per rinforzo dei suoi più recenti modelli destinati alla distribuzione, rafforzato la sicurezza dei propri ambienti di ricerca e ampliato il monitoraggio prima di riprendere alcuni carichi di lavoro con controlli più rigorosi.
Le parole di Brown descrivono quindi una priorità con due obiettivi collegati: rendere gli agenti capaci di contribuire alla prossima generazione di IA e costruire i controlli necessari a mantenere quei sistemi sotto la direzione umana. La tappa dichiarata da OpenAI è un tirocinante di ricerca entro settembre 2026; il suo obiettivo più ambizioso è un ricercatore di IA automatizzato entro marzo 2028.