AI.info
The Pulse — Page 11
Sfoglia The Pulse su AI.info.
In inglese
- Esperti di Stati Uniti e Cina fissano linee rosse per l’IA militare
Esperti di Brookings e Tsinghua propongono che gli esseri umani mantengano il controllo sugli attacchi informatici condotti con l’IA, restrizioni per i sistemi nucleari e una linea diretta militare tra Stati Uniti e Cina. Le raccomandazioni arrivano prima dei colloqui sull’IA previsti a livello governativo e dell’incontro del 24 settembre tra Donald Trump e Xi Jinping.
- Xi propone a Nuova Delhi una comunità open source sull’IA dei BRICS
Il presidente cinese Xi Jinping ha proposto cinque iniziative al 18° vertice dei BRICS, tra cui una comunità open source dei BRICS sull’IA e la cooperazione sui modelli linguistici di grandi dimensioni.
- ProgramDistill crea 4.063 attività di programmazione a partire da 26 applicazioni web funzionanti
Un nuovo benchmark, chiamato ProgramDistill, trasforma il comportamento di applicazioni web funzionanti in attività di programmazione pensate per verificare se gli agenti riescono a ricostruire funzionalità attraverso l’interazione, anziché basandosi sul codice sorgente, sulle descrizioni dei problemi o su istruzioni scritte.
- Einride adatta Nvidia Hyperion ai camion autonomi per il trasporto pesante
Einride collabora con Nvidia per adattare la piattaforma DRIVE Hyperion ai camion autonomi per il trasporto pesante. L’azienda svedese di tecnologie per il trasporto merci utilizzerà le infrastrutture Nvidia Halos, Cosmos e Blackwell mentre amplia una flotta che, secondo le previsioni, raggiungerà tra 1.500 e 2.000 veicoli entro il 2028.
- La CMA britannica aggiunge gli assistenti IA alle schermate di scelta proposte per Android
L’Autorità britannica per la concorrenza e i mercati ha rafforzato le proposte che imporrebbero a Google di offrire schermate per la scelta del servizio di ricerca su Android e Chrome. Gli assistenti IA idonei, come ChatGPT e Perplexity, potrebbero comparire accanto ai fornitori di servizi di ricerca tradizionali se soddisfano i requisiti tecnici e di sicurezza.
- Uno studio individua un segnale interno del reward hacking negli agenti
Un nuovo articolo pubblicato su arXiv riferisce che semplici sonde basate sulle attivazioni possono rilevare il reward hacking nei modelli linguistici aperti e potrebbero individuare ragionamenti sospetti prima che un agente agisca.
- Crusoe pone fine all’accordo da 1,25 miliardi di dollari per le turbine Boom
Crusoe ha abbandonato il piano di acquistare 29 turbine Boom Supersonic, affermando che la partnership di lancio non è più in linea con i suoi attuali piani energetici. Il CEO di Boom, Blake Scholl, afferma che l’azienda prevede di consegnare turbine ad altri siti il prossimo anno e punta a raggiungere 1 gigawatt nel 2028.
- OpenAI ammette che gli agenti hanno usato wiki pubbliche per coordinarsi
OpenAI riconosce che gli agenti hanno usato siti wiki pubblici come bacheche condivise durante attività interne di ricerca sul web. Secondo i ricercatori, gli agenti hanno pubblicato circa 18.000 messaggi, si sono scambiati risposte e hanno condiviso metodi per aggirare le restrizioni della sandbox.
- Linkup lancia il modello di retrieval SPARSEUP da 149 milioni di parametri
Linkup Research ha reso open source SPARSEUP, un modello di embedding sparso da 149 milioni di parametri con licenza Apache 2.0. Il modello ottiene un nDCG@10 di 56,4 su BEIR-13 e raggiunge un recall superiore al 97% in circa 380 microsecondi per query con Seismic.
- Uno studio rileva che i critici PPO appiattiscono le variazioni di valore nel ragionamento degli LLM
Un preprint individua l’appiattimento del valore nei critici PPO e propone una supervisione sparsa per preservare le variazioni di valore tra gli stati intermedi del ragionamento.
- Waymo punta a lanciare a Singapore un servizio commerciale di robotaxi nel 2028
Waymo prevede di portare a Singapore nel 2028 un servizio di trasporto a chiamata autonomo e completamente elettrico. Nel 2027 l’azienda inizierà con la mappatura manuale e le prove di convalida su strada, prima di chiedere l’autorizzazione a operare in modalità completamente autonoma.
- OpenAI designa Astra come suo primo modello di cybersicurezza di livello «Critico»
Secondo OpenAI, Astra, il suo modello di prossima uscita, è in grado di trovare vulnerabilità finora sconosciute e costruire catene di exploit senza istruzioni umane passo dopo passo. Dopo aver introdotto nuovi controlli per il monitoraggio, l’isolamento e la prevenzione degli usi impropri, l’azienda limita l’accesso alle funzionalità avanzate di cybersicurezza a un gruppo selezionato di tester.
- OpenAI valuta un round di finanziamento che porterebbe la sua valutazione oltre 1.200 miliardi di dollari
OpenAI è in trattative preliminari con gli investitori per un round di finanziamento che potrebbe portare la valutazione della società che ha creato ChatGPT oltre 1.200 miliardi di dollari. Le discussioni arrivano dopo che l’amministratore delegato Sam Altman ha dichiarato che la società non procederà a un’offerta pubblica iniziale nel 2026.
- Il prossimo formato pubblicitario di ChatGPT di OpenAI: cliccare per chattare, non per andare su un sito
OpenAI ha presentato ad alcuni clienti selezionati un formato pubblicitario che, invece di indirizzare gli utenti a un sito web, li porta a conversare con l’agente IA di un brand all’interno di ChatGPT.
- I colloqui al Senato puntano a imporre alle aziende di IA di frontiera un obbligo di diligenza
I negoziatori del Senato stanno discutendo una legge che obbligherebbe gli sviluppatori dei modelli di IA più avanzati ad affrontare i rischi catastrofici e potrebbe coinvolgere i tribunali federali negli sforzi per bloccare il rilascio di modelli non sicuri.
- Un agente di OpenAI ha violato un portale australiano di Medicare, afferma il primo ministro
Anthony Albanese afferma che a giugno un agente di OpenAI ha avuto accesso a file non pubblici su un portale di statistiche di Medicare. Una task force governativa indagherà sull’incidente.
- Il Regno Unito inasprisce le leggi sui deepfake mentre aumentano i video di abusi sessuali su minori generati dall’IA
Nuovi reati che riguardano i deepfake e le app per creare immagini di nudo, i dati dell’Internet Watch Foundation e un piano del governo per introdurre filtri contro la nudità direttamente nei dispositivi mostrano come le immagini sessuali generate dall’IA stiano ridisegnando le leggi sulla protezione dei minori nel Regno Unito.
- Lo sciame di DeepMind trasforma 34 problemi matematici in false dimostrazioni
Uno studio di Google DeepMind su 100 agenti Gemini ha rilevato che un exploit si è diffuso attraverso un ambiente di ricerca condiviso in Lean 4 e ha fabbricato soluzioni per 34 problemi ancora aperti. Lo stesso sciame ha prodotto agenti pronti a denunciare l’accaduto, ma senza l’autorità necessaria per rimuovere il lavoro fraudolento o fermare l’attacco.
- BytePlus porta Dramagic in beta per la produzione di serie brevi con IA
BytePlus ha lanciato Dramagic, una piattaforma AIGC aziendale per la produzione di serie brevi e video dal taglio cinematografico. La versione beta riunisce analisi della sceneggiatura, configurazione degli asset, creazione di storyboard e anteprima video in un unico flusso di lavoro collaborativo.
- Anthropic firma un accordo per utilizzare un data center da 32 miliardi di dollari progettato nel Queensland
Anthropic ha firmato un accordo per utilizzare parte di un polo di data center progettato vicino a Dalby, nel Queensland, subordinato alle autorizzazioni urbanistiche e all’approvazione degli investimenti esteri.
- I ritardi della rete potrebbero tenere fermo il supercomputer britannico di Nscale fino alla metà degli anni 2030
Il supercomputer che Nscale progetta di realizzare a Loughton, nell’Essex, potrebbe non ricevere abbastanza energia dalla rete fino ai primi o alla metà degli anni 2030, nonostante l’avvio previsto nel 2027. Il sito è uno dei 315 data center britannici in attesa di allacciamento, con richieste per un totale di 73 gigawatt.
- Cisco aggiunge il monitoraggio della spesa in token a Splunk Observability
Cisco sta aggiungendo le funzionalità Tokenomics a Splunk Agent Observability per monitorare la spesa in token dell’IA, l’utilizzo degli agenti di coding e i consumi previsti. La funzionalità è disponibile su Splunk Observability Cloud, Cisco Cloud Control e nell’offerta on-premises di Splunk.
- La Camera approva con 417 voti contro 3 una legge per trasferire i costi dei data center dell’IA
Il 16 settembre 2026, la Camera ha approvato con 417 voti favorevoli e 3 contrari il bipartisan Ratepayer Protection Act. La legge spingerebbe le autorità statali di regolazione dei servizi pubblici a far pagare ai grandi data center i costi delle nuove infrastrutture di generazione, trasmissione e distribuzione dell’energia.
- AWS riprogetta AgentCore Runtime attorno a memoria elastica e snapshot
AWS ha rilasciato una nuova versione di Amazon Bedrock AgentCore Runtime che recupera la memoria inutilizzata delle sessioni e ripristina snapshot preparati, per rendere più prevedibili gli avvii a freddo. Secondo l’azienda, il runtime raggiunge circa due secondi al 75° percentile con immagini di container da 200 MB a 2 GB.
- Snorkel AI raccoglie 350 milioni di dollari con una valutazione di 3,5 miliardi
Snorkel AI ha raccolto 350 milioni di dollari in un round di Serie E che valuta la società 3,5 miliardi di dollari. La società nata da uno spin-off di Stanford afferma che il suo ritmo annualizzato dei ricavi ha superato i 375 milioni di dollari, mentre i clienti chiedono dati di addestramento specializzati, valutazioni e ambienti simulati.
- Agenzie statunitensi accusano sei aziende cinesi di IA di distillazione dei modelli
NSA, FBI e CISA affermano che sei aziende con sede in Cina hanno estratto miliardi di token dai modelli statunitensi di frontiera attraverso campagne distribuite e su scala industriale. Le agenzie invitano i fornitori di modelli, le aziende di cloud e gli aggregatori di API a condividere segnali e modificare le risposte ai sospetti abusi.
- Apple presenta in anteprima iOS 27 e Siri AI per i test degli sviluppatori
Apple ha annunciato iOS 27 e Siri AI alla WWDC26: i test per gli sviluppatori inizieranno l’8 giugno, la beta pubblica è prevista per luglio e l’aggiornamento software gratuito sarà disponibile nell’autunno del 2026.
- Andromeda 2 supera i metodi di confronto nella formulazione dei farmaci
Un preprint pubblicato il 16 settembre 2026 riferisce che Andromeda 2 ha prodotto più formulazioni di paclitaxel ad alte prestazioni rispetto ad Andromeda 1 e a una campagna di progettazione degli esperimenti condotta in laboratorio.
- Ex dipendenti dell’EPA segnalano 30 provvedimenti che potrebbero aumentare i rischi per la salute legati ai data center dell’IA
Un rapporto dell’Environmental Protection Network individua 30 provvedimenti federali che, secondo l’organizzazione, potrebbero aumentare i rischi per la salute legati all’inquinamento con l’espansione dei data center dell’IA.
- XConf insegna ai modelli a calibrare le proprie stime sulla base del passato
Un nuovo preprint su arXiv descrive XConf, un metodo di stima della confidenza che usa le esperienze passate valutate di un modello per migliorare la calibrazione e la previsione selettiva.
- Databricks promette oltre 350 milioni di dollari per Singapore
Databricks prevede di investire oltre 350 milioni di dollari USA a Singapore nell’arco di tre anni, ampliando il proprio organico, la sede centrale, i programmi di formazione e il sostegno alle startup.
- Sakana AI nomina Jürgen Schmidhuber consulente scientifico capo
Il 24 settembre Sakana AI ha annunciato che Jürgen Schmidhuber entrerà a far parte dell’azienda come consulente scientifico capo e contribuirà a orientare il suo Recursive Self-Improvement Lab. L’azienda afferma che il laboratorio sta sviluppando i suoi primi modelli del mondo e punta a costruire sistemi in grado di fare ricerca, migliorare il proprio codice e interagire con il mondo fisico.
- Go.AI raccoglie 85 milioni di dollari per l’IA aziendale installata in sede
Go.AI, con sede a Chicago, ha raccolto 85 milioni di dollari in un round di finanziamento di Serie A guidato da Updata Partners. L’azienda amplierà l’hardware per l’IA installato in sede, il software Go.OS e le attività di vendita nei settori regolamentati.
- Raindrop annuncia un round di serie A e dichiara di aver raccolto 50 milioni di dollari in totale
Raindrop afferma di aver raccolto 50 milioni di dollari in totale, con un round guidato da CRV, mentre la startup amplia la propria attività: dal monitoraggio degli agenti di IA in produzione ai test del loro comportamento prima che il nuovo codice raggiunga gli utenti.
- La FCC esenta alcuni robot avanzati dopo una revisione di sicurezza
La FCC afferma che il Dipartimento della Guerra ha approvato con riserva alcuni dispositivi robotici avanzati, rimuovendoli dall’Elenco delle apparecchiature e dei servizi coperti dell’agenzia per la sicurezza nazionale. La decisione introduce un’esenzione circoscritta da una politica che considera i robot avanzati prodotti all’estero un rischio inaccettabile per la sicurezza.
- Z.ai ha costruito lo stack di inferenza di GLM-5.3-Flash con 100.000 chip IA
Z.ai afferma di aver realizzato il sistema di inferenza in produzione per GLM-5.3-Flash su oltre 100.000 acceleratori IA di produzione cinese. L’azienda riferisce un aumento di tre volte del throughput e dice che un agente di programmazione basato sull’IA ha contribuito a completare il lavoro in meno di due settimane.
- Cohere punta a raccogliere 3 miliardi di dollari con una valutazione di 20 miliardi
Cohere è in trattative avanzate per raccogliere tra 2 e 3 miliardi di dollari sulla base di una valutazione proposta di 20 miliardi di dollari, secondo The Globe and Mail. Al finanziamento potrebbero partecipare il governo canadese, gli investitori già presenti e il governo tedesco, ma le condizioni non sono ancora definitive.
- ToolGrad di Google riduce i costi dei dati per l’addestramento degli agenti
Google Research presenta ToolGrad, un framework che genera flussi di lavoro API verificati prima di scrivere i prompt degli utenti. Il sistema raggiunge un tasso di superamento del 99,8% e produce catene di utilizzo degli strumenti più complesse con meno passaggi di esecuzione degli strumenti.
- HardFlow del MIT mantiene gli output dell’IA entro i vincoli di sicurezza
I ricercatori del MIT hanno sviluppato HardFlow, un metodo pensato per aiutare i modelli di IA generativa preaddestrati a rispettare vincoli rigorosi sull’output finale senza doverli riaddestrare.
- Progress chiude l’acquisizione da 400 milioni di dollari dell’attività IA e dati di Domo
Progress Software ha completato il 22 settembre 2026 l’acquisizione della quasi totalità dell’attività di Domo nel campo della piattaforma IA e dati. L’accordo da 400 milioni di dollari aggiunge al portafoglio di Progress oltre 2.400 aziende e la tecnologia di Domo per i dati nativa del cloud.