Vai al contenuto
AI.info

The Pulse

SpaceXAI lancia Grok 4.7 per la programmazione e il lavoro intellettuale

Il 21 settembre 2026 SpaceXAI ha lanciato Grok 4.7, presentandolo come un sistema per la programmazione, le attività agentiche e il lavoro intellettuale professionale, anziché come un aggiornamento generale di un chatbot.

SpaceXAI lancia Grok 4.7 per la programmazione e il lavoro intellettuale

AI.info Team ·

SpaceXAI punta su attività di programmazione più lunghe

Il 21 settembre 2026 SpaceXAI ha lanciato Grok 4.7, presentandolo come un sistema per la programmazione, le attività agentiche e il lavoro intellettuale professionale, anziché come un aggiornamento generale di un chatbot. L’azienda afferma che il modello è disponibile in Cursor e Grok Build, tramite la Grok API e attraverso strumenti di orchestrazione per la programmazione di terze parti, router di modelli e piattaforme cloud.

SpaceXAI descrive Grok 4.7 come il suo modello più capace per la programmazione e il lavoro intellettuale. Secondo l’annuncio, il modello lavora più a lungo su compiti difficili, controlla il proprio lavoro con maggiore attenzione e integra le misure di sicurezza meglio calibrate dell’azienda finora. Viene offerto allo stesso prezzo standard e alla stessa velocità di Grok 4.6.

L’azienda afferma che Grok 4.7 utilizza un nuovo modello di base, più grande di Grok 4.6, e un ciclo di apprendimento per rinforzo più lungo, basato su una combinazione di compiti più impegnativa e con maggiore enfasi sui problemi che possono richiedere molte ore per essere completati. SpaceXAI afferma inoltre che il modello è più bravo a verificare il proprio lavoro e a gestire contesti più lunghi. È stato addestrato per comprendere nativamente l’ambiente Grok Bot, cosa che, secondo l’azienda, ne migliora le prestazioni nelle attività conversazionali e nel lavoro intellettuale in generale.

Questo orientamento mette a disposizione un criterio chiaro per valutare il lancio: SpaceXAI presenta Grok 4.7 come un collaboratore più affidabile negli incarichi prolungati, mentre i risultati pubblicati mostrano progressi rispetto a Grok 4.6, ma non collocano il modello al primo posto in ogni confronto. La tabella dell’azienda assegna a Fable 5.1 risultati superiori su CursorBench 4.0 e Terminal-Bench 4.0, mentre GPT-5.6 Sol ottiene punteggi più alti su DeepSWE v1.1 e HealthBench Professional.

Grok 4.7 migliora rispetto a Grok 4.6

Su CursorBench 4.0, che SpaceXAI descrive come un test di attività di programmazione di lunga durata, Grok 4.7 ottiene il 46,3%, contro il 40,4% di Grok 4.6 e il 41,7% di GPT-5.6 Sol. Fable 5.1 registra il 51,8% nello stesso test.

Il modello mostra un miglioramento maggiore su Terminal-Bench 4.0, salendo al 38,0% dal 20,3% di Grok 4.6. GPT-5.6 Sol ottiene il 37,3%, mentre Fable 5.1 raggiunge il 57,9%. Su DeepSWE v1.1, Grok 4.7 ottiene il 71,0% nella configurazione ad alto impegno, contro il 65,2% del predecessore; GPT-5.6 Sol è in testa al confronto con il 72,7%.

SpaceXAI riporta inoltre un punteggio di 1.657 su AA Briefcase v1.1, un benchmark per il lavoro d’ufficio che si svolge nell’arco di più ore. Grok 4.6 ottiene 1.546, GPT-5.6 Sol 1.487 e Fable 5.1 1.678. I risultati riguardano attività tipiche di professionisti come avvocati, infermieri e analisti finanziari, tra cui la creazione di documenti e presentazioni.

In altri confronti, Grok 4.7 ottiene il 64,0% su EEBench, contro il 53,0% di Grok 4.6, il 39,4% di GPT-5.6 Sol e il 56,4% di Fable 5.1. Il modello ottiene anche il 19,6% sull’Harvey Legal Agent Benchmark, superando il 15,8% di Grok 4.6, il 2,5% di GPT-5.6 Sol e il 6,7% di Fable 5.1.

Prezzi e disponibilità

Grok 4.7 parte da 2 dollari per milione di token in ingresso e 6 dollari per milione di token in uscita. SpaceXAI afferma che il modello è disponibile da oggi in Cursor e Grok Build, oltre che tramite la Grok API, strumenti di orchestrazione per la programmazione di terze parti, router di modelli e piattaforme cloud.

L’azienda offre anche una variante veloce, con una velocità di generazione doppia a un prezzo doppio. SpaceXAI rimanda gli sviluppatori alla console API e alla documentazione per accedere al modello e consultare i dettagli tecnici. L’annuncio fornisce un comando per installare lo strumento a riga di comando dell’azienda e rimanda gli utenti a Grok Build per iniziare.

SpaceXAI aggiunge una nuova dichiarazione sulla sicurezza

Il lancio include un nuovo insieme di misure di sicurezza per Grok 4.7. SpaceXAI afferma che il modello è il più efficace tra quelli testati dall’azienda nel rifiutare richieste e resistere ai jailbreak. In ambiti a duplice uso come la cybersicurezza e il lavoro biologico, l’azienda afferma che il modello coniuga l’utilità per le attività benigne con un comportamento più sicuro nel rifiutare richieste pericolose.

Nel benchmark di biosicurezza di LatchBio, SpaceXAI riporta un punteggio del 62,4%. L’azienda afferma inoltre che Grok 4.7 lascia passare il 3,3% dei prompt rischiosi a duplice uso su HackerBench v0.3, il suo benchmark per attività informatiche rischiose e malevole, e che raramente blocca attività di sicurezza legittime.

SpaceXAI afferma che alcuni partner selezionati nel campo della cybersicurezza hanno ricevuto accesso esclusivamente su invito alle capacità di red teaming di Grok 4.7 per la ricerca in ambito difensivo. I risultati pubblicati sono autodichiarati nell’annuncio del lancio, che non identifica i partner partecipanti né fornisce una verifica indipendente dei risultati dei benchmark.

Per gli sviluppatori, il cambiamento immediato è l’accesso a un modello pensato per incarichi più lunghi di programmazione e lavoro intellettuale, con un prezzo di partenza di 2 dollari per milione di token in ingresso e 6 dollari per milione di token in uscita. Grok 4.7 è accessibile tramite l’API e i prodotti di programmazione dell’azienda con il nome del modello grok-4.7.

Fonte

Esplora

Altri articoli