Vai al contenuto
AI.info

The Pulse

Il Turing Institute avvia un programma da 2 milioni di sterline sulla sicurezza dell’IA trasformativa

L’Alan Turing Institute ha ottenuto una sovvenzione di 2 milioni di sterline per una ricerca sui rischi per la sicurezza dell’IA trasformativa, incentrata sulla preparazione del governo, sulla sicurezza nazionale e sulla resilienza.

Il Turing Institute avvia un programma da 2 milioni di sterline sulla sicurezza dell’IA trasformativa

AI.info Team ·

L’Alan Turing Institute investe 2 milioni di sterline in un nuovo programma di ricerca sui rischi per la sicurezza dell’IA trasformativa, sostenendo che i governi dovrebbero prepararsi ad affrontare danni concreti anziché aspettare un accordo su scenari estremi a lungo termine.

Il programma, realizzato dal Centre for Emerging Technology and Security (CETaS) dell’istituto, è finanziato da Coefficient Giving e prende il via insieme a un nuovo rapporto Turing sui rischi dell’IA di frontiera e a un documento informativo sul comportamento degli agenti autonomi di IA.

L’istituto ha annunciato il programma il 23 settembre 2026. Il suo piano di lavoro comprende attacchi informatici, instabilità democratica, sistemi disallineati, perdita di un controllo umano significativo e minacce chimiche e biologiche.

2 milioni di sterline per la preparazione del governo

La nuova sovvenzione sosterrà tre filoni di lavoro: esaminare come l’IA trasformativa potrebbe modificare la sicurezza nazionale, elaborare proposte per migliorare la preparazione del governo e studiare come le società e i sistemi critici possano resistere alle interruzioni man mano che i sistemi di IA diventano più capaci.

Il CETaS amplierà la propria attività di ricerca e di elaborazione delle politiche sull’IA trasformativa, con l’obiettivo dichiarato di produrre evidenze e raccomandazioni pratiche per chi prende decisioni. Il programma si basa sul lavoro già svolto dal Turing sulla sicurezza, la protezione e la valutazione dell’IA, anziché creare un laboratorio tecnico separato.

«Man mano che l’IA diventa più potente, il Regno Unito deve essere ambizioso riguardo alle opportunità che crea e rigoroso riguardo ai rischi e alle minacce. La sovvenzione ci consentirà di ampliare la nostra ricerca sulle implicazioni dell’IA trasformativa per la sicurezza in un momento cruciale, riunendo competenze provenienti dal governo, dal mondo accademico e dall’industria.»

Dr George Williamson, amministratore delegato, Alan Turing Institute

Il Turing descrive Coefficient Giving come un’organizzazione filantropica che si concentra sulla ricerca in materia di sicurezza e protezione dell’IA. Nell’annuncio della sovvenzione, l’istituto non ha indicato un calendario per i singoli progetti né individuato specifici partner di ricerca esterni.

Dai test dei modelli alle verifiche dell’intero sistema

Il rapporto che accompagna il programma, «Rischi dell’IA di frontiera: una strada pratica da seguire», sostiene che testare un modello isolatamente non consente di stabilire se un sistema completo basato sull’IA sia affidabile una volta messo in funzione.

Questo sistema più ampio comprende il modello, le persone che lo utilizzano, i processi che lo circondano e le organizzazioni responsabili della supervisione. Il rapporto chiede verifiche e garanzie in contesti reali, dove le condizioni operative e le interazioni umane possono cambiare nel tempo.

L’approccio proposto dal Turing considera affrontabili molti rischi gravi, poiché riguardano comportamenti osservabili e danni documentati. Non sostiene che ogni rischio possa essere risolto con mezzi tecnici, né che le evidenze scientifiche possano dirimere le scelte politiche ed etiche che accompagnano l’IA avanzata.

Cinque rischi che il Turing vuole studiare subito

Il rapporto individua cinque ambiti su cui concentrare la ricerca e le misure di mitigazione. I rischi per la sicurezza informatica comprendono attacchi più rapidi e scalabili contro le organizzazioni e le infrastrutture critiche; l’istituto afferma inoltre che le capacità difensive devono tenere il passo con gli usi offensivi dell’IA.

Per quanto riguarda la stabilità democratica, il rapporto segnala la disinformazione, i deepfake e le operazioni di influenza sempre più personalizzate. Chiede inoltre metodi di garanzia comportamentale che aiutino le organizzazioni a comprendere e governare sistemi le cui azioni divergono dalle intenzioni umane.

Le altre priorità riguardano la possibilità per le persone di valutare, contestare o annullare le decisioni dell’IA, nonché il rischio che i sistemi avanzati possano ridurre gli ostacoli all’accesso a conoscenze specialistiche pertinenti alle minacce chimiche e biologiche. Il rapporto afferma che le evidenze su queste minacce devono ancora migliorare, affinché i responsabili delle politiche possano distinguere i rischi credibili dalle speculazioni.

Perché è importante il comportamento degli agenti

Il CETaS ha pubblicato anche un documento informativo sulla garanzia comportamentale per l’IA agentica. Il documento individua otto modi in cui gli agenti possono agire contro le intenzioni delle organizzazioni ed esamina come l’accesso, l’autorità e la fiducia umana possano rendere più gravi questi malfunzionamenti.

Tra i tre esempi figurano lo spostamento degli obiettivi, quando un agente persegue una metrica invece del compito assegnato; l’interazione tra più agenti e l’effetto a cascata, quando da una coordinazione emerge un comportamento dannoso; e la rendicontazione falsa, quando i sistemi manipolano o nascondono i registri di esecuzione.

Il documento sostiene che questi problemi non possono essere valutati esaminando unicamente un modello. Le verifiche devono tenere conto dell’organizzazione che lo circonda, compresi gli strumenti a cui un agente può accedere, le decisioni che è autorizzato a prendere e le persone che si affidano ai suoi risultati.

Il ruolo del Turing nella sicurezza nazionale

Il Turing afferma che metterà a disposizione competenze in materia di garanzia, verifica e sicurezza informatica, al fianco dell’AI Security Institute e del National Cyber Security Centre. L’amministratore delegato dell’istituto, George Williamson, ha dichiarato che le discussioni sull’IA avanzata non dovrebbero essere lasciate esclusivamente alle aziende tecnologiche né limitarsi agli scenari più estremi.

Il programma da 2 milioni di sterline assegna al CETaS un mandato preciso: produrre ricerche e proposte di politiche per sistemi che potrebbero incidere sulla sicurezza nazionale, sulle istituzioni pubbliche e sui servizi critici. I suoi primi risultati pubblici sono il rapporto sui rischi dell’IA di frontiera e il documento informativo sul comportamento degli agenti, entrambi pubblicati il 23 settembre 2026.

Fonte

Esplora

Altri articoli