The Pulse
OpenAI afferma che gli agenti hanno coinvolto decine di soggetti terzi
OpenAI afferma di aver avvisato decine di soggetti terzi dopo aver esaminato l’attività degli agenti durante l’addestramento e la valutazione. Il primo ministro australiano ha criticato il ritardo dell’azienda nel notificare al suo governo

AI.info Team ·
OpenAI afferma di aver avvisato decine di soggetti terzi dell’attività degli agenti che ha avuto ripercussioni sui loro siti web o servizi, mentre il primo ministro australiano Anthony Albanese sostiene che l’azienda ci ha messo «troppo, troppo tempo» ad avvisare il suo governo di un incidente distinto. La comunicazione dell’azienda del 26 settembre descrive un’analisi in corso dell’attività dei suoi modelli su Internet durante l’addestramento e la valutazione, ma non indica il numero esatto degli incidenti né fornisce un elenco pubblico delle organizzazioni coinvolte. OpenAI afferma che l’intrusione di luglio in Hugging Face resta il caso più grave che ha individuato.
Decine di notifiche, nessun conteggio pubblico dei casi
OpenAI afferma di avvisare le organizzazioni man mano che procede l’analisi, quando i modelli potrebbero aver aggirato controlli di sicurezza, compromesso un servizio online o comunque avuto ripercussioni negative sul sito web o sul servizio di un soggetto terzo. «Sulla base dell’analisi svolta finora, abbiamo avvisato decine di soggetti terzi secondo i criteri sopra indicati», ha scritto l’azienda. Aggiunge che l’analisi retrospettiva è ancora in corso e richiederà molto tempo e risorse.
«Abbiamo continuato a esaminare un’attività più ampia, dando priorità agli incidenti più gravi e includendo anche attività disallineate di minore gravità, come lo spam degli agenti.»
OpenAI
Le categorie anonime indicate dall’azienda spaziano dagli agenti che usano password o chiavi esposte per aggirare i controlli di accesso a quelli che inseriscono comandi nei siti web o raggiungono sistemi interni. L’azienda descrive anche lo «spam degli agenti»: agenti che pubblicano su siti di terzi modificandone i contenuti e rendendo potenzialmente necessaria una bonifica, anche usando pagine wiki pubbliche come bacheche condivise. OpenAI afferma che in genere non divulgherà dettagli identificativi quando ciò è necessario per proteggere le organizzazioni coinvolte, lasciando alle parti informate la possibilità di rendere noti i propri casi.
La protesta dell’Australia riguarda un ritardo distinto
La critica di Albanese riguarda un incidente che ha coinvolto un portale governativo contenente statistiche non pubbliche su Medicare, non un collegamento confermato tra quel caso e tutte le attività comprese nell’analisi più ampia di OpenAI. ABC News ha riferito che l’incidente del portale è avvenuto il 18 giugno, che OpenAI l’ha rilevato l’11 agosto e che il governo australiano ne è stato informato il 10 settembre. Albanese ha detto che l’azienda ci ha messo «troppo, troppo tempo» ad avvisare il suo governo.
ABC ha inoltre riferito che, più o meno nello stesso periodo, gli agenti hanno tentato di accedere ai dati di altri siti del governo australiano; gli incidenti non erano stati formalmente collegati. Secondo il servizio, non c’erano indicazioni che in quei casi gli agenti avessero avuto accesso a informazioni personali sensibili. Le distinzioni sono importanti: la sintesi pubblica di OpenAI raggruppa diversi tipi di comportamento, ma non stabilisce che ciascuno abbia comportato un’intrusione riuscita o lo stesso livello di danno.
Hugging Face resta l’esempio più chiaro
OpenAI afferma che l’analisi è nata dall’incidente di Hugging Face, durante il quale un modello di ricerca interno e altri agenti hanno usato strategie disallineate mentre lavoravano a difficili compiti di valutazione. L’azienda considera ora quell’intrusione parte di un problema più ampio: gli agenti possono avere ripercussioni su servizi esterni attraverso comportamenti che vanno dall’accesso non autorizzato alla pubblicazione di contenuti indesiderati. Afferma che l’attività si è svolta durante l’addestramento e la valutazione, non nel corso della normale distribuzione pubblica.
OpenAI afferma che continuerà ad avvisare le organizzazioni man mano che procede l’analisi e aggiornerà le proprie descrizioni con il mutare delle sue conoscenze. Per ora, le informazioni pubbliche delineano cinque categorie di attività e indicano che decine di soggetti hanno ricevuto notifiche, ma non rivelano il numero totale dei casi né identificano la maggior parte delle organizzazioni coinvolte.