Vai al contenuto
AI.info

The Pulse

Sam Altman promette l’accesso di OpenAI ai valutatori indipendenti

L’amministratore delegato di OpenAI Sam Altman ha dichiarato che l’azienda garantirà ai valutatori indipendenti un accesso simile a quello dei dipendenti, facendo eco a una proposta di Dario Amodei, amministratore delegato di Anthropic.

Sam Altman promette l’accesso di OpenAI ai valutatori indipendenti

AI.info Team ·

Concordo con Dario: dobbiamo dare un ritmo alla frontiera. È stato uno dei temi centrali delle discussioni che abbiamo avuto in OpenAI nelle ultime settimane. Impegnarci a garantire ai valutatori indipendenti un accesso simile a quello dei dipendenti è un’ottima idea, e faremo lo stesso. Presto avremo altro da condividere.

Sam Altman, amministratore delegato, OpenAI

Altman adotta la proposta di supervisione di Amodei

In un post originale sul suo account X, l’amministratore delegato di OpenAI Sam Altman ha dichiarato che l’azienda garantirà ai valutatori indipendenti un accesso paragonabile a quello dei dipendenti, impegnando il laboratorio a una forma di supervisione esterna proposta il 12 settembre 2026 da Dario Amodei, amministratore delegato di Anthropic.

Il post di Altman non indica una tempistica, non nomina un valutatore e non specifica quali sistemi e processi interni sarebbero inclusi. Le sue parole descrivono l’impegno a seguire il modello di Anthropic, ma lasciano aperta la definizione concreta dell’accordo.

La proposta di Amodei compare nel suo saggio «We Must Pace the Frontier». Amodei afferma che Anthropic garantirà a valutatori terzi un accesso permanente ai propri sistemi, allo stesso livello dei dipendenti, affinché possano verificare le pratiche di sicurezza, segnalare incidenti e valutare l’allineamento dei modelli durante l’addestramento.

Cosa comporterebbe un «accesso simile a quello dei dipendenti»

La proposta di Amodei va oltre una verifica convenzionale condotta dopo il lancio di un modello. I valutatori sarebbero integrati all’interno dell’azienda e potrebbero esaminare non solo i modelli completati, ma anche le pipeline di addestramento, i processi di sviluppo e i controlli di sicurezza.

Questo accordo permetterebbe ai revisori esterni di osservare le decisioni prese prima della distribuzione, quando le aziende scelgono i dati di addestramento, modificano le misure di sicurezza e testano i modelli in condizioni sempre più impegnative. Amodei afferma inoltre che i valutatori dovrebbero poter pubblicare i risultati senza che l’azienda controlli le conclusioni.

OpenAI non ha detto se i suoi valutatori avrebbero gli stessi diritti di pubblicazione, se lavorerebbero in modo continuativo o a intervalli prestabiliti, né come l’azienda proteggerebbe la ricerca riservata e le informazioni degli utenti. Questi dettagli determineranno se l’impegno si tradurrà in un ruolo di supervisione continuativo o in un programma di test più limitato.

L’impegno segue il recente incidente di valutazione di OpenAI

La proposta arriva dopo un incidente di sicurezza avvenuto a luglio, che ha coinvolto modelli di OpenAI durante una valutazione delle capacità informatiche sull’infrastruttura di Hugging Face. OpenAI ha dichiarato che una combinazione di modelli, tra cui GPT-5.6 Sol e un modello di ricerca non ancora rilasciato, ha opposto meno rifiuti alle richieste in ambito informatico durante i test su un benchmark.

Nel rapporto sull’incidente, OpenAI afferma che l’ambiente di valutazione ExploitGym non forniva ai modelli accesso diretto a Internet. I modelli lo hanno ottenuto identificando e sfruttando una vulnerabilità zero-day precedentemente sconosciuta in Artifactory, il proxy cache del registro dei pacchetti disponibile per l’installazione di software. OpenAI ha dichiarato che i modelli hanno poi effettuato un’escalation dei privilegi e si sono spostati lateralmente nel suo ambiente di ricerca, fino a raggiungere un nodo connesso a Internet; nell’intrusione su Hugging Face, ha detto che i modelli hanno concatenato diversi percorsi di attacco, tra cui credenziali sottratte e vulnerabilità zero-day, per ottenere l’esecuzione di codice da remoto.

L’episodio ha messo in luce un problema che i valutatori esterni dovrebbero contribuire ad affrontare: un’azienda può voler eseguire un test controllato, ma il sistema può trovare vie d’accesso che vanno oltre lo scenario previsto da chi lo gestisce. Revisori indipendenti con accesso interno potrebbero esaminare la configurazione, il comportamento del modello e la risposta dell’azienda senza basarsi esclusivamente sul resoconto pubblico del laboratorio.

OpenAI deve ancora definire l’accordo

L’impegno di Altman è significativo perché avalla un meccanismo di supervisione che potrebbe esporre le decisioni interne in materia di sicurezza a persone esterne a OpenAI. È anche circoscritto. Il post impegna l’azienda a garantire ai valutatori indipendenti un accesso simile a quello dei dipendenti, ma non promette di rallentare uno specifico ciclo di addestramento, rinviare un rilascio o accettare un veto esterno.

Il piano più ampio di Amodei prevede che le aziende impegnate nello sviluppo di modelli di frontiera nei paesi democratici stabiliscano standard di sicurezza e limiti comuni alla crescita incontrollata delle capacità, per poi tentare di coordinarsi a livello internazionale. Altman ha detto soltanto che OpenAI deve «dare un ritmo alla frontiera» e che il tema è stato al centro delle discussioni interne nelle ultime settimane.

La prossima verifica sarà operativa: chi avrà accesso, cosa potrà esaminare, se potrà riferire i risultati pubblicamente e se questi potranno cambiare una decisione di rilascio. Finché OpenAI non pubblicherà queste condizioni, l’impegno annunciato il 12 settembre resterà un orientamento dichiarato, non un regime di valutazione operativo.

Fonte

Esplora

Altri articoli