Vai al contenuto
AI.info

The Pulse

Secondo un’inchiesta, collaboratori di OpenAI leggono conversazioni reali di ChatGPT

Un’inchiesta di 404 Media basata su documenti trapelati e fonti anonime afferma che alcuni collaboratori esaminano le conversazioni di ChatGPT per contribuire alla valutazione delle risposte.

Secondo un’inchiesta, collaboratori di OpenAI leggono conversazioni reali di ChatGPT

AI.info Team ·

Oltre 900 milioni di utenti e alcune chat finiscono sotto gli occhi di revisori umani

OpenAI si avvale di centinaia di collaboratori per leggere prompt reali inviati a ChatGPT e valutare le risposte del chatbot, secondo un’inchiesta successiva pubblicata da 404 Media il 14 settembre 2026. Il reportage si basa su documenti interni trapelati e fonti anonime. Un collaboratore ha riferito a 404 Media che, in ultima analisi, è Mercor a pagare i revisori. I prompt possono includere conversazioni complete e informazioni personali sensibili, anche se molti utenti potrebbero credere di comunicare soltanto con un software.

I collaboratori lavorano nell’ambito di un’iniziativa interna chiamata Project Lily. Il loro compito è migliorare le risposte di ChatGPT riassumendo ciò che vuole l’utente, confrontando diverse risposte generate, assegnando loro un punteggio e spiegando quali parti funzionano o non funzionano.

Secondo il dato citato da 404 Media, il chatbot di OpenAI ha oltre 900 milioni di utenti. Le dimensioni di questa base di utenti fanno sì che il processo di revisione dell’azienda attinga a un flusso ampio e variegato di conversazioni quotidiane, comprese richieste su relazioni personali, lavoro, salute e supporto emotivo.

Project Lily trasforma i prompt privati in attività di addestramento

I documenti esaminati da 404 Media descrivono un processo in tre fasi. Per prima cosa, un revisore legge il prompt dell’utente, poi scrive una breve spiegazione di ciò che la persona cerca di ottenere e infine valuta una serie di risposte di ChatGPT. Il revisore deve individuare punti di forza o debolezze specifici e motivare per iscritto la propria valutazione.

Il sistema di valutazione va da uno a sette. Un punteggio pari a uno indica una risposta «inaccettabile, inutilizzabile», mentre sette significa che «sarebbe difficile migliorarla in modo sostanziale». Anche informazioni utili possono ricevere un punteggio basso se la risposta è troppo lunga, disordinata, poco adatta al tono dell’utente o piena di abitudini stilistiche che ne riducono l’utilità.

Le istruzioni di Project Lily chiedono ai revisori di segnalare adulazione, imitazione forzata dello stile dell’utente, supposizioni paternalistiche, escalation emotiva e conclusioni pensate per mantenere alta l’attenzione degli utenti. I documenti chiedono inoltre di penalizzare il «linguaggio da IA» e l’uso inappropriato di emoji, e di fare in modo che ChatGPT si esprima in modo naturale senza presentarsi come una persona con esperienze personali.

«No», ha risposto una persona che lavora con i prompt, quando le è stato chiesto se pensa che gli utenti di ChatGPT sappiano che degli esseri umani leggono le loro chat. «Non credo che immaginerebbero che un collaboratore qualunque [...] stia analizzando le conversazioni».

Addetto ai prompt anonimo, citato da Joseph Cox, giornalista di 404 Media

OpenAI afferma di filtrare prima le informazioni personali

OpenAI ha dichiarato a 404 Media di elaborare le conversazioni con una versione del proprio modello Privacy Filter prima di inviarle ai collaboratori. L’azienda afferma che il sistema è progettato per rilevare e rimuovere le informazioni personali, ma la documentazione di OpenAI riconosce che il filtro può non individuare identificativi poco comuni, interpretare male riferimenti ambigui e rimuovere informazioni in eccesso o non abbastanza quando il contesto è limitato.

I revisori non vedono il nome utente di ChatGPT. Alcuni prompt possono comunque contenere dettagli identificativi e la dashboard di revisione può includere un «riepilogo dei ricordi dell’utente» che descrive gli usi precedenti del chatbot, comprese eventuali informazioni sulla posizione e altri dettagli personali.

Le istruzioni per i collaboratori chiedono ai revisori di segnalare le attività che riguardano potenziali problemi di sicurezza o informazioni personali. 404 Media ha inoltre trovato prompt che suggeriscono che alcuni utenti non si aspettassero un controllo umano, comprese richieste di mantenere privata la conversazione con ChatGPT.

OpenAI non ha risposto alla domanda di 404 Media sul fatto che informi esplicitamente gli utenti che i prompt possono essere esaminati da persone per migliorare le risposte. Dopo la pubblicazione, l’azienda ha rimandato a una pagina di assistenza in cui si afferma che i contenuti possono essere esaminati da persone per migliorare le prestazioni dei modelli. OpenAI ha anche aggiornato la spiegazione dell’impostazione che determina se le conversazioni vengono usate per migliorare i suoi modelli.

L’impostazione predefinita lascia molti utenti con l’opzione attiva

OpenAI ha dichiarato a 404 Media che gli utenti possono impedire che le nuove conversazioni vengano usate per migliorare i suoi modelli disattivando l’impostazione «Improve the model for everyone». L’opzione è attiva per impostazione predefinita negli account Free, Plus e Pro: gli utenti devono quindi modificarla se non vogliono che le nuove chat vengano incluse.

Secondo il reportage, l’impostazione non sembra applicarsi retroattivamente. Eliminare le conversazioni non rimuove necessariamente i contenuti che sono già stati privati dei dati identificativi e separati dall’account dell’utente, se quest’ultimo ha consentito a OpenAI di usare i contenuti per migliorare i modelli.

Per i clienti Enterprise, Business ed Edu, l’impostazione che consente di migliorare i modelli è disattivata per impostazione predefinita. Gli account organizzativi partono quindi da una condizione diversa rispetto ai piani per i consumatori usati dalla maggior parte dei singoli utenti di ChatGPT.

I collaboratori valutano lo stile oltre all’accuratezza

Project Lily non si limita a verificare se una risposta è corretta dal punto di vista dei fatti. Ai revisori viene chiesto di valutare se la risposta comprende l’intento dell’utente, offre un aiuto utile, usa un tono adeguato ed evita di suggerire che ChatGPT abbia emozioni o una storia personale.

Un documento di istruzioni chiede ai revisori di preferire risposte «utili», «oneste & veritiere», «che rafforzano l’autonomia» e «intelligenti, ma umili». In genere non ci si aspetta che i revisori verifichino le risposte con ricerche esterne, anche se devono segnalare i problemi di accuratezza o correttezza che notano. A quanto pare, alcuni team distinti si occupano di determinate verifiche; inoltre, ci si aspetta che le risposte su temi medici, legali e finanziari ad alto rischio includano fonti, se opportuno.

I documenti non specificano quale modello di OpenAI stiano addestrando i collaboratori. Il materiale esaminato da 404 Media usa soltanto il nome in codice Project Lily, senza chiarire se il lavoro riguardi un modello già disponibile o una versione futura.

OpenAI non è l’unica azienda a ricorrere alla revisione umana

404 Media ha scoperto che anche altre grandi aziende che sviluppano chatbot includono la valutazione umana nel processo di miglioramento dei modelli. L’interfaccia Gemini di Google avverte che alcune chat salvate vengono esaminate da persone per migliorare i suoi sistemi di IA. Anthropic ha dichiarato alla testata di ricorrere alla revisione umana per gli utenti che attivano l’impostazione «Help improve our AI models» e di rimuovere prima della revisione identificativi dell’account come gli indirizzi email.

Michal Luria, ricercatrice senior presso il Center for Democracy and Technology, ha dichiarato a 404 Media che la revisione umana può contribuire al lavoro sulla sicurezza, ma ha avvertito che le interfacce dei chatbot creano un’illusione di riservatezza. Le conversazioni possono sembrare scambi privati anche quando un’azienda può inoltrarle a valutatori umani.

Sarah T. Roberts, docente alla UCLA e autrice di Behind the Screen: Content Moderation in the Shadows of Social Media, ha paragonato il meccanismo al «Mago di Oz», dove la magia apparente dipende dalle persone che lavorano dietro le quinte. Il collaboratore intervistato da 404 Media ha detto che il lavoro può essere divertente, ma è generalmente ripetitivo e si svolge seguendo linee guida che cambiano e talvolta si contraddicono.

Il reportage mostra il processo di lavoro che sta dietro alle risposte curate che gli utenti vedono su ChatGPT: si selezionano conversazioni reali, si filtrano in modo imperfetto i dettagli personali e i collaboratori assegnano un punteggio alle risposte del sistema, una per una. Per gli utenti consumer, il controllo immediato è l’impostazione per migliorare i modelli, che resta attiva per impostazione predefinita negli account Free, Plus e Pro.

Fonte

Esplora

Altri articoli