Vai al contenuto
AI.info

The Pulse

Cantina presenta Apex Flash-1, un modello di sicurezza a pesi aperti da 321 miliardi di parametri

Cantina afferma che Apex Flash-1 ha risolto 40 compiti su 60, relativi a 20 casi di vulnerabilità esclusi dall’addestramento, con un costo stimato di esecuzione inferiore a quello dei modelli usati per il confronto. L’azienda ha rilasciato

Cantina presenta Apex Flash-1, un modello di sicurezza a pesi aperti da 321 miliardi di parametri

AI.info Team ·

Apex Flash-1 ha risolto 40 compiti di sicurezza su 60 nella valutazione di Cantina, ottenendo un punteggio pass-at-one del 66,7% per il nuovo modello a pesi aperti dell’azienda. Cantina ha rilasciato il modello il 2 ottobre 2026 insieme a Yeta Labs, descrivendolo come uno strumento per indagini mirate sulle vulnerabilità, non come un agente di sicurezza autonomo. Il checkpoint da 321 miliardi di parametri è disponibile su Hugging Face con licenza MIT.

Cantina ha creato 150 compiti di addestramento a partire da 50 casi di vulnerabilità

Cantina afferma di aver trasformato 50 casi di vulnerabilità in 150 compiti di addestramento, creando per ciascun caso tre versioni con diversi livelli di accesso e di indicazioni. Nei compiti white-box guidati, il modello riceve il codice sorgente e indicazioni dettagliate; quelli white-box mirati forniscono il codice ma meno indicazioni; quelli black-box mirati offrono indicazioni limitate e accesso a un bersaglio in esecuzione, senza il relativo codice sorgente. Cantina ha usato GLM-5.3-Flash come modello di base e ha applicato l’apprendimento per rinforzo con GRPO.

I casi si basano su vulnerabilità che Cantina afferma di aver individuato durante la propria attività di sicurezza. Secondo il comunicato di rilascio, il 72% dei 50 casi di addestramento riguardava autorizzazioni, identità o vincoli di ambito; gli altri riguardavano contabilità e precisione, validazione temporale e riutilizzo delle firme, regole di business e validazione dei pagamenti, e falsificazione di richieste lato server. L’azienda costruisce ambienti funzionanti simili a quelli di produzione e verifica se un agente ottiene un risultato definito su un bersaglio in esecuzione.

Un esempio ricrea una falla nell’isolamento degli artefatti in Forgejo, una piattaforma open source per l’hosting di codice. Un agente con accesso a un workflow doveva ricostruire come un URL di download firmato e una successiva ricerca di un artefatto gestissero in modo diverso i permessi dei workflow, per poi recuperare un artefatto da un workflow separato e protetto. Cantina afferma che il suo sistema di verifica controllava se il modello avesse recuperato il contenuto dell’artefatto protetto.

Il risultato sui 60 compiti consente un confronto circoscritto

Su 60 compiti tratti da 20 casi di vulnerabilità esclusi dall’addestramento, Apex Flash-1 ne ha risolti 40, contro i 36 del modello di base GLM-5.3-Flash e i 43 di Claude Opus 5 High. I risultati corrispondono rispettivamente a punteggi pass-at-one del 66,7%, del 60% e del 71,7%. Cantina ha stimato il costo di esecuzione dell’intera serie di compiti in 2,38 dollari per Apex Flash-1, 4,56 dollari per il modello di base e 74,68 dollari per Opus 5 High, usando i prezzi dei fornitori.

I dati provengono dalla valutazione condotta da Cantina: ciascun modello ha eseguito la serie di compiti una sola volta e i casi provenivano da ambienti costruiti dall’azienda. Offrono un confronto su questo specifico test, non una valutazione indipendente su altri software, team di sicurezza o configurazioni degli agenti. La scheda del modello di Cantina lo descrive come destinato a compiti di sicurezza basati su testo e precisa che le sue prestazioni su immagini e video non sono state valutate.

Una versione «abliterated» modifica il compromesso sulla sicurezza

Cantina ha rilasciato anche una versione derivata sperimentale «abliterated», con un comportamento di rifiuto modificato. L’azienda presenta i modelli locali e controllabili come utili per chi difende i propri sistemi, sostenendo che gli aggressori possono adattare i modelli aperti indipendentemente dalle politiche aziendali sull’utilizzo. Nel comunicato di rilascio, Cantina afferma:

Il problema è che la cybersicurezza è un campo in cui si contrappongono avversari.

Secondo la sua scheda, la versione con comportamento di rifiuto modificato non è limitata alle richieste relative alla sicurezza e non è stata sottoposta a una valutazione separata sull’intera batteria di test. Il risultato di 40 compiti risolti su 60 riguarda il checkpoint standard di Apex Flash-1, non la versione derivata. Cantina afferma che il modello è destinato a essere usato sotto la direzione di un agente più ampio; i pesi scaricabili, tuttavia, non sono soggetti a questa limitazione.

Le prestazioni al di fuori del test di Cantina restano da misurare

Con questo rilascio, i casi di sicurezza vengono incorporati in un modello che gli sviluppatori possono scaricare ed eseguire, mentre il benchmark resta un test di piccole dimensioni condotto dall’azienda nei propri ambienti. Cantina afferma di voler ampliare la composizione dei dati, aggiungere casi a più passaggi più difficili e addestrare il modello con diversi framework per agenti. Sebbene Cantina riporti risultati su 20 casi di vulnerabilità esclusi dall’addestramento, questa valutazione non stabilisce come le prestazioni si trasferiscano a basi di codice sconosciute o ad altre configurazioni di orchestrazione.

Fonti

Esplora

Altri articoli