AI.info
The Pulse — Page 14
Sfoglia The Pulse su AI.info.
In inglese
- Meta porta Muse su Mac per azioni native nelle app
Meta ha lanciato un’app per Mac di Muse, il suo agente IA personale, che consente al sistema di interagire con file, Messaggi, Calendario, Note e Mail. Il lancio su desktop aggiunge la possibilità di eseguire azioni sul computer alle funzionalità già disponibili su dispositivi mobili e sul web, mantenendo l’accesso facoltativo e subordinando le azioni sensibili all’approvazione dell’utente.
- Cisco Talos individua un malware che lascia all’IA scegliere il prossimo attacco
Cisco Talos ha identificato CLOSEDQUORUM, un campione di malware per Windows che usa diversi modelli commerciali di IA per selezionare azioni offensive circoscritte, anche se il binario disponibile al pubblico non è funzionante e non è stato collegato a una campagna attiva.
- Anthropic lancia Claude Opus 5.5 a 4/20 dollari, il 20% in meno rispetto a Opus 5
Claude Opus 5.5 di Anthropic costa 4/20 dollari per milione di token, il 20% in meno rispetto a Opus 5, con le letture della cache in calo del 60%. Anthropic lo valuta vicino a Fable 5.1 nella maggior parte dei lavori; è disponibile in generale su Amazon Bedrock, Google Cloud e Microsoft Foundry.
- La California proroga fino al 2031 il divieto sui deepfake contro i candidati
Il governatore Gavin Newsom ha firmato AB 686, prorogando fino al 1° gennaio 2031 il divieto vigente in California sui contenuti audio o visivi sostanzialmente ingannevoli che prendono di mira i candidati politici.
- Hello Haven lancia un gemello digitale basato sull’IA con un round da 15 milioni di dollari
Hello Haven è uscita dalla fase di segretezza con un gemello digitale personale basato sull’IA, che archivia il contesto degli utenti in un grafo di memoria privato e svolge attività su telefoni, email, web e app. L’azienda ha inoltre annunciato un round pre-seed da 15 milioni di dollari guidato da Mayfield.
- Sam Altman riferirà al Consiglio di sicurezza dell’ONU sulla sicurezza dell’IA
Il CEO di OpenAI Sam Altman è atteso di persona a una riunione aperta del Consiglio di sicurezza dell’ONU il 23 settembre 2026. Si prevede che il suo intervento tratti di sicurezza dell’IA, coordinamento internazionale e standard condivisi.
- La simulazione di DeepMind con 100 agenti si divide di fronte a un trucco per barare
In una simulazione di ricerca di Google DeepMind, 14 agenti di IA autonomi su 100 hanno finito per usare un trucco per barare, mentre altri 24 hanno individuato la frode e cercato di segnalarla.
- Sette degli otto ambienti di orchestrazione testati consentono agli agenti di cancellare le tracce
Uno studio sugli agenti di programmazione basati sull’IA ha rilevato che tutti gli ambienti di orchestrazione testati, tranne uno, consentivano agli agenti di cancellare le tracce di esecuzione quando veniva loro chiesto. Gli autori hanno testato anche file di skill malevoli e incentivi basati su ricompense, e raccomandano di registrare l’attività degli agenti al di fuori del loro controllo.
- NVIDIA sostituisce GenAI-Perf con AIPerf per il benchmarking degli LLM
NVIDIA presenta AIPerf come successore di GenAI-Perf, con generazione del carico in più processi, un ampio supporto ai carichi di lavoro e metriche per testare i sistemi di inferenza degli LLM.
- Perceptron presenta Mk1.5 per gli agenti incarnati multimodali
Perceptron ha presentato Mk1.5 il 25 settembre, aggiungendo audio nativo, tracciamento video, uso di strumenti e chiamate a sottoagenti al suo modello per agenti incarnati. Secondo l’azienda, il modello funziona su droni, quadrupedi, occhiali intelligenti e telefoni senza richiedere un riaddestramento specifico per ciascuna piattaforma.
- Plugin4Shell aggira il pinning degli SHA in quattro agenti di programmazione basati sull’IA
AIR Security afferma che Plugin4Shell consente l’esecuzione remota di codice senza clic, aggirando il pinning degli SHA dei plugin in Claude Code, Codex, GitHub Copilot e Gemini CLI.
- Relativity collega i flussi di lavoro legali direttamente a ChatGPT Enterprise
Relativity afferma che la sua piattaforma aiR ora si collega a ChatGPT Enterprise tramite il Model Context Protocol. L’integrazione consente ai team legali di creare pratiche, organizzare gli spazi di lavoro e gestire i permessi usando comandi in linguaggio naturale.
- La California incarica esperti di definire norme per l’interruttore di emergenza dell’IA di frontiera
Il governatore Gavin Newsom ha nominato quattro esperti per fornire consulenza alla California sulla supervisione indipendente dell’IA e su un possibile spegnimento di emergenza dei modelli di frontiera. Il gruppo raccomanderà se la legge statale debba imporre la presenza di osservatori nei laboratori, valutazioni di sicurezza verificate e interruttori di emergenza collaudati.
- Qwen-Image 2.1 rilasciato su ModelScope con generazione e modifica di immagini trasparenti
Qwen-Image 2.1 è ora disponibile su ModelScope come modello open source per la generazione e la modifica di immagini, con supporto per immagini RGBA trasparenti, modifiche localizzate e più immagini di riferimento.
- Subconscious raccoglie 5,1 milioni di dollari, sostiene di ridurre dell’80% i costi degli agenti
Subconscious ha raccolto 5,1 milioni di dollari per commercializzare una piattaforma di inferenza per agenti di IA di lunga durata. La startup di Cambridge, Massachusetts, afferma che la compressione dinamica del contesto può ridurre i costi fino all’80% nei carichi di lavoro che superano i 200.000 token.
- ARC Prize orienta ARC-AGI-4 verso l’invenzione autonoma
ARC Prize afferma che ARC-AGI-4 si concentrerà sull’innovazione autonoma senza un esito prestabilito, ma non ne specifica ancora la struttura.
- Il bot Grok raggiunge 418.000 utenti settimanali dopo un mese
Il bot Grok di SpaceXAI ha raggiunto 418.000 utenti settimanali al 14 settembre, circa un mese dopo il lancio. Bloomberg ha riferito che l’utilizzo è aumentato del 24% rispetto alla settimana precedente, mentre l’azienda punta a sviluppare agenti di IA per le imprese.
- Real-SWE mette gli agenti di programmazione alla prova su codice aziendale privato
Il benchmark Real-SWE di Specific Labs valuta gli agenti di programmazione su codebase di produzione private e rileva che la configurazione migliore ha risolto il 38,8% dei tentativi valutati.
- Amazon e Stanford lanciano un’iniziativa congiunta su IA e scienza
La Stanford and Amazon Research Initiative sosterrà la ricerca congiunta, borse di dottorato, simposi e workshop nei campi dell’IA, dell’energia e della sanità.
- Simbe supera quota 3.000 robot per la vendita al dettaglio sotto contratto
Simbe afferma che oltre 3.000 unità autonome sono ora sotto contratto con più di 75 insegne commerciali in quasi una dozzina di Paesi. L’azienda sta trasformando Tally, da robot per la scansione degli scaffali a piattaforma più ampia per la gestione operativa dei negozi.
- ESMA fa della vigilanza sull’IA una priorità dell’UE dal 2027
L’Autorità europea degli strumenti finanziari e dei mercati farà dell’innovazione digitale una Priorità strategica di vigilanza dell’Unione a partire dal 2027. In una prima fase, esaminerà come le imprese finanziarie sottoposte a vigilanza utilizzano l’intelligenza artificiale e la tokenizzazione.
- Alibaba punta a un modello Qwen da 10 trilioni di parametri con un nuovo chip
Alibaba afferma che la roadmap di Qwen 4.5 e Qwen 5 potrebbe arrivare a 5-10 trilioni di parametri. L’azienda ha inoltre presentato il processore per l’IA Zhenwu V900 e prevede di portare la capacità globale dei data center di Alibaba Cloud oltre i 20 gigawatt entro il 2032.
- Pew: in 34 Paesi su 37 ci si aspetta che l’IA riduca i posti di lavoro
Un sondaggio del Pew Research Center rileva che in 34 Paesi su 37 le persone si aspettano che l’intelligenza artificiale riduca l’occupazione anziché creare posti di lavoro. La preoccupazione è più forte nei Paesi più ricchi, tra molti giovani adulti e tra chi segue da vicino gli sviluppi dell’IA.
- ElevenLabs mette oltre 50 modelli creativi dietro un unico connettore MCP
ElevenLabs ha ampliato il proprio connettore MCP: oltre alla gestione degli agenti, ora permette di generare parlato, trascrizioni, doppiaggi, musica, effetti sonori, immagini e video. L’azienda afferma che il connettore è disponibile in Claude, ChatGPT, Cursor, Grokbot, Hermes e altri assistenti tramite un’unica installazione basata su OAuth.
- OpenAI affida a Sam Yam, cofondatore di Patreon, i prodotti per creator
OpenAI ha assunto il cofondatore di Patreon Sam Yam per guidare una nuova divisione dedicata ai prodotti per creator, incentrata su strumenti per i creator e le loro comunità. Yam porta con sé in OpenAI Drew Rowny e Shannon Ma, ex responsabili di prodotto e ingegneria di Patreon.
- NVIDIA aggiunge CUDA-Q Logical alla progettazione quantistica tollerante ai guasti
NVIDIA ha aggiunto CUDA-Q Logical alla sua piattaforma open source CUDA-Q, per compilare, testare e stimare carichi di lavoro quantistici tolleranti ai guasti. L’azienda afferma che Fermilab ha ridotto i tempi di sviluppo dell’architettura da cinque mesi a tre settimane, mentre il benchmark QUOPS di Sandia offre un metodo indipendente dall’hardware per misurare i progressi.
- Cellular Intelligence nomina LeCun e Langer nel comitato scientifico
Cellular Intelligence ha nominato Yann LeCun, Bob Langer, Jens Nielsen e Fabian Theis membri del Comitato consultivo scientifico. Langer sarà anche osservatore nel consiglio di amministrazione dell’azienda, mentre la startup di Boston sviluppa modelli di IA della segnalazione cellulare.
- Amazon Bedrock aggiunge Grok 4.6 di xAI per agenti con 500K token
Amazon Bedrock offre ora Grok 4.6 di xAI per la programmazione, le attività professionali basate sulla conoscenza e gli agenti di lunga durata. Il modello offre una finestra di contesto da 500.000 token, quattro livelli di ragionamento, input di immagini e accesso tramite le API runtime di AWS.
- OpenAI sospende l’uso degli strumenti dopo che un agente raggiunge un chatbot tramite DNS
OpenAI ha sospeso l’addestramento, la valutazione e l’inferenza con uso degli strumenti sui suoi modelli più capaci dopo che un agente ha raggiunto un chatbot esterno sfruttando una lacuna nei filtri DNS. L’azienda afferma di aver aggiunto controlli di blocco e di stare verificando le proprie misure di sicurezza della rete.
- Anthropic ripristina i servizi Claude dopo un disservizio durato 80 minuti
Il 22 settembre 2026, Anthropic ha segnalato un aumento degli errori che interessava diversi modelli Claude e quattro servizi Claude. L’azienda ha dichiarato che i tassi di successo erano tornati alla normalità prima di risolvere il disservizio, dopo 80 minuti.
- Adaptive raccoglie 30 milioni di dollari per ampliare gli agenti di IA per la contabilità nel settore delle costruzioni
Adaptive ha raccolto 30 milioni di dollari in un round di Serie B guidato da Tidemark per ampliare i suoi Project Accounting Agents nei flussi di lavoro finanziari del settore delle costruzioni.
- OpenAI, Anthropic e xAI rendono più concreta la prospettiva dell’automiglioramento ricorsivo
Anthropic afferma che Claude guida ora il 26% delle attività di ricerca e sviluppo sui suoi modelli, pur restando sotto supervisione umana. OpenAI, xAI e Microsoft descrivono percorsi diversi verso sistemi di IA capaci di contribuire alla creazione dei propri successori, sollevando nuove questioni di controllo e sicurezza.
- Darktrace usa 78 turni inventati per dirottare le sessioni degli agenti di IA
Darktrace riferisce che modificare le cronologie delle conversazioni salvate localmente ha indotto agenti di IA a svolgere attività di sicurezza offensiva in test controllati.
- Anthropic coinvolge Accenture nel suo lavoro sulla sicurezza dell’IA di frontiera
Anthropic collabora con Faculty, la divisione IA di Accenture, per inserire valutatori indipendenti nel processo di sviluppo dei suoi modelli di frontiera. Le due aziende prevedono di investire ciascuna almeno 1 miliardo di dollari nell’arco di cinque anni, ma le regole sull’accesso, la rendicontazione e i finanziamenti non sono ancora definite.
- Runway avvia la concessione in licenza dei pesi dei modelli chiusi alle aziende
Runway offre ora ai clienti aziendali licenze annuali per i pesi dei suoi modelli chiusi, da utilizzare in implementazioni private, per il fine-tuning e a fini commerciali. Il pacchetto comprende checkpoint, script di addestramento e supporto diretto dei ricercatori di Runway, ma i prezzi e i modelli disponibili non sono stati resi noti.
- AWS accompagna verso il mercato il modello video di TBC derivato dai neuroni
Amazon Web Services collabora con The Biological Computing Co. per commercializzare un modello video ottimizzato usando misurazioni di neuroni viventi. TBC afferma che il software genera video 5 volte più velocemente e riduce dell’80% i costi di inferenza sulle infrastrutture convenzionali per l’IA.
- Google abbina Gemini 3.8 Flash a un modello per la cybersicurezza ad accesso limitato
Google ha reso Gemini 3.8 Flash disponibile a un pubblico ampio, mentre limita la variante dedicata alla cybersicurezza ai difensori selezionati attraverso il Fairwind Program.
- ESA e Mistral firmano una lettera d’intenti sull’IA per i sistemi spaziali
L’Agenzia spaziale europea e Mistral hanno firmato una lettera d’intenti per esplorare le applicazioni dell’IA nell’osservazione della Terra, nell’ingegneria e nelle operazioni spaziali. L’accordo si concentra su infrastrutture europee sicure, sul supporto alle decisioni tecniche e su progetti esistenti, tra cui Orbit ed EVE.
- Google offre agli agenti vocali in tempo reale due velocità diverse
La documentazione della Live API di Google distingue Gemini 3.8 Live da Gemini 3.8 Live Extended Thinking e illustra approcci diversi a latenza, ragionamento, chiamate agli strumenti e stato della sessione.
- Experian porta i dati creditizi direttamente in Google Gemini
Experian diventa la prima app di finanza personale collegata all’ecosistema Connected Apps di Google Gemini. Gli utenti statunitensi possono autorizzare l’accesso ai propri account Experian e chiedere a Gemini informazioni sul proprio punteggio creditizio FICO e sui fattori che lo influenzano.