Vai al contenuto
AI.info

The Pulse

Fastly aggiunge controlli runtime per gli agenti di IA aziendali

Fastly lancia AI Runtime Control, AI Firewall e funzionalità di API Security per i sistemi di IA aziendali. I prodotti offrono controlli centralizzati sull’accesso ai modelli, sulla spesa, sulla difesa dagli attacchi di prompt injection e s

Fastly aggiunge controlli runtime per gli agenti di IA aziendali

AI.info Team ·

Fastly sta introducendo un livello di controllo tra le applicazioni aziendali e i modelli di IA che utilizzano, scommettendo sul fatto che le aziende dovranno limitare i sistemi autonomi nel momento in cui effettuano richieste, anziché sottoporre quelle azioni a verifica in un secondo momento.

Il 21 settembre 2026, l’azienda di cloud edge con sede a San Francisco ha annunciato AI Runtime Control, AI Firewall e nuove funzionalità di API Security. I prodotti intervengono in tre punti distinti di un sistema di IA aziendale: le applicazioni che chiamano i modelli, gli utenti che interagiscono con le applicazioni di IA e gli agenti che chiamano le API aziendali interne.

Fastly presenta il lancio come una risposta a un disaccordo che oggi coinvolge i team tecnologici aziendali. Gli sviluppatori vogliono che gli agenti possano chiamare modelli e sistemi aziendali con il minor numero possibile di ostacoli; i team di sicurezza e finanza vogliono porre limiti alle autorizzazioni, al consumo di token e alle richieste potenzialmente dannose. I prodotti dell’azienda applicano questi controlli nel percorso delle richieste.

L’annuncio di Fastly afferma che a luglio e agosto 2026 il traffico generato dalle macchine ha rappresentato oltre il 50% del traffico sulla sua rete. Aggiunge che da gennaio a maggio il traffico di IA è cresciuto a una velocità 6,5 volte superiore a quella del traffico umano, citando inoltre la stima di McKinsey secondo cui il 93% delle organizzazioni sta superando il proprio budget per l’IA.

Fastly riunisce le richieste di IA in un unico piano di controllo

AI Runtime Control, o ARC, si colloca tra le applicazioni e i fornitori di modelli pubblici o ospitati autonomamente. Le applicazioni inviano le richieste ai modelli a un endpoint gestito da Fastly invece di chiamare direttamente ciascun fornitore. ARC identifica quindi la chiave virtuale e il modello, applica i limiti, sostituisce le credenziali del fornitore e restituisce la risposta.

Questo design offre agli amministratori un unico punto da cui gestire l’accesso ai fornitori, senza che ogni applicazione debba contenere le chiavi originali dei fornitori. Fastly afferma che le chiavi virtuali possono essere assegnate ad applicazioni, team, sviluppatori o sessioni, quindi ruotate o revocate senza modifiche al codice lato client. L’azienda afferma inoltre che i clienti possono continuare a usare i propri rapporti con i fornitori e le tariffe negoziate, adottando il modello bring-your-own-key.

ARC registra l’utilizzo dei token, il volume delle richieste e i costi calcolati per chiavi virtuali e sessioni client. Può applicare budget mensili in dollari, limiti di richieste al minuto e limiti di token al minuto. Fastly afferma che questi controlli servono a contenere i cicli incontrollati degli agenti autonomi, i picchi di traffico imprevisti e altri usi che potrebbero esaurire le quote dei fornitori.

«Per adottare efficacemente gli agenti di programmazione e implementare funzionalità di IA senza perdere velocità o compromettere la resilienza aziendale esistente, le imprese hanno bisogno di controllo in produzione, in fase di esecuzione, senza ritardi, ostacoli o interruzioni», ha dichiarato Kelly Shortridge, responsabile dei prodotti di Fastly, nell’annuncio dell’azienda.

AI Firewall mira a contrastare la prompt injection nel percorso delle richieste

AI Firewall opera come modulo di sicurezza all’interno di ARC. Fastly afferma che analizza i prompt nel percorso delle richieste per individuare e bloccare gli attacchi rivolti alle applicazioni di IA, tra cui la prompt injection e altri attacchi ideati per i sistemi basati su modelli linguistici di grandi dimensioni.

Il prodotto utilizza il motore di rilevamento SmartParse di Fastly e misure di protezione personalizzate. La documentazione del prodotto di Fastly descrive AI Firewall come un livello opzionale attivabile all’interno di ARC, con un rilevamento progettato per avere un impatto pressoché nullo sulla latenza.

La pagina del prodotto di Fastly afferma che il sistema analizza le richieste per individuare minacce specifiche per i modelli, applica misure di protezione alle risposte e convalida gli output per verificare il comportamento di rifiuto e l’eventuale fuga di informazioni. Nei materiali di lancio, l’azienda non fornisce risultati di test indipendenti né un tasso misurato di rilevamento degli attacchi.

API Security limita ciò che gli agenti possono fare

La terza parte dell’annuncio riguarda il confine tra gli agenti di IA e i software aziendali. Le funzionalità di API Security di Fastly applicano i contratti API al traffico basato su agenti, assistito da agenti e convenzionale. Le organizzazioni possono monitorare o bloccare le richieste non conformi alle regole specifiche dei servizi.

Questo approccio affronta un problema concreto degli agenti: le loro autorizzazioni dipendono spesso dalle API a cui possono accedere, non solo dal modello che genera le istruzioni. Fastly afferma che i suoi controlli possono aiutare a impedire agli agenti di richiedere operazioni non supportate, inviare payload non validi o agire al di fuori dei confini API stabiliti.

L’azienda descrive la funzionalità come un livello di policy per gli agenti che accedono alle API aziendali, non come un sistema che determina se l’obiettivo più ampio di un agente sia appropriato. L’annuncio non afferma inoltre che Fastly verifichi in modo indipendente l’identità o l’intento di un agente prima di ogni richiesta.

Failover e budget integrano la gestione operativa nel prodotto

ARC si occupa anche di affidabilità e gestione dei costi. Una chiave virtuale può puntare a un elenco ordinato di modelli, consentendo a Fastly di riprovare una richiesta non riuscita e indirizzarla a un fornitore di riserva quando quello principale restituisce errori. L’applicazione continua a utilizzare lo stesso endpoint.

La pagina di ARC di Fastly afferma che gli amministratori possono impostare un budget mensile per ogni chiave virtuale e scegliere se il servizio debba interrompersi o proseguire una volta raggiunto il limite. Il prodotto offre anche avvisi all’80% e al 100% del budget configurato, oltre a dashboard che mostrano il numero di token, il volume delle richieste e la spesa.

Queste funzionalità riuniscono in un unico servizio l’instradamento dei modelli, le credenziali dei fornitori, i controlli di sicurezza e la contabilizzazione dell’utilizzo. In un post separato sul prodotto, Fastly afferma di rispondere alle esigenze delle aziende che attualmente utilizzano connessioni dirette ai fornitori, chiavi API condivise e strumenti separati per la registrazione, i limiti di frequenza e il monitoraggio dei costi.

Fastly estende la propria attività di sicurezza edge

Il lancio amplia il portafoglio di sicurezza esistente di Fastly, anziché introdurre una piattaforma indipendente per agenti. L’azienda afferma che la sua offerta di IA combina ARC e AI Firewall con Bot Management, DDoS Protection, API Discovery, ContentGuard e il suo firewall per applicazioni web di nuova generazione.

La proposta di Fastly riguarda quindi il punto in cui vengono applicati i controlli. L’accesso ai modelli, l’analisi dei prompt, i limiti di utilizzo e l’applicazione delle regole API possono essere gestiti tramite un’infrastruttura che l’azienda già utilizza per distribuire e proteggere il traffico delle applicazioni. L’approccio potrebbe interessare i clienti che vogliono un unico livello di rete per le richieste degli utenti, il traffico automatizzato e le chiamate all’IA, ma nei materiali di lancio non vengono specificati i prezzi, le condizioni di disponibilità generale né le implementazioni presso i clienti.

Per ora, l’offerta concreta di Fastly consiste in un livello proxy e di policy: ARC gestisce l’instradamento verso i modelli, AI Firewall verifica gli attacchi diretti ai modelli e API Security limita le richieste che gli agenti inviano ai servizi aziendali.

Fonte

Esplora

Altri articoli