AI.info
The Pulse — Page 15
Sfoglia The Pulse su AI.info.
In inglese
- InferenceX apre il confronto tra TPU e Nvidia nell’inferenza
SemiAnalysis ha pubblicato i primi risultati di terze parti di InferenceX per la TPUv7 Ironwood di Google, a confronto con B200 e B300 di Nvidia. Il benchmark mostra che Ironwood raggiunge prestazioni per dollaro fino al 50% superiori in alcuni carichi di serving FP8, mettendo però in luce limiti software e di latenza.
- Huang di Nvidia respinge gli appelli a rallentare lo sviluppo dell’IA avanzata
Durante una telefonata in diretta all’All-In Summit di Los Angeles, Jensen Huang ha detto al presidente Donald Trump che Nvidia non avrebbe sostenuto un rallentamento dello sviluppo dell’IA.
- Google dice che Gemini 4 potrebbe arrivare ben prima della fine dell’anno
Il responsabile di Google DeepMind, Koray Kavukcuoglu, afferma che Gemini 4 è nelle prime fasi del post-training e che Google spera di pubblicarne una versione preliminare ben prima della fine del 2026. Spiega anche perché Google ha spostato l’attenzione da Gemini 3.5 Pro ai modelli Flash più piccoli.
- Evvy raccoglie 40 milioni di dollari per trasformare i dati vaginali in ricerca sull’IA
Evvy raccoglie 40 milioni di dollari in un round di Serie B guidato da Catalio Capital Management per ampliare la sua piattaforma sul microbioma vaginale e la ricerca sulla salute femminile. L’azienda prevede di usare il suo dataset, che comprende 100.000 pazienti, per studiare la fertilità, gli esiti della FIV e nuovi marcatori diagnostici.
- L’IA di Stanford restringe 1,7 milioni di polimeri a 10 candidati antibiotici
I ricercatori di Stanford hanno addestrato un modello di IA a esaminare 1,7 milioni di polimeri candidati alla ricerca di molecole che imitano i peptidi in grado di uccidere i batteri. Dieci candidati hanno superato le aspettative contro E. coli, e uno si è dimostrato particolarmente promettente contro i biofilm.
- fJscaler fornisce campioni di un TIA da 100 GHz per i collegamenti dei datacenter per l’IA
fJscaler afferma di fornire a clienti strategici campioni di un amplificatore a transimpedenza BiCMOS da 100 GHz per le interconnessioni ottiche dei datacenter per l’IA e il cloud. Il ricevitore punta a un’efficienza energetica di 0,85 pJ/bit, una densità di rumore di 18 pA/√Hz e collegamenti da 200G per canale.
- DeepSeek V4.1-Flash riduce i costi degli agenti con un’architettura Causal Encoder-Decoder
DeepSeek ha rilasciato V4.1-Flash, un modello MoE da 552 miliardi di parametri con visione nativa, contesto da 1 milione di token e cache KV ridotta a un quarto delle dimensioni precedenti. Dal 14 settembre il modello instrada il traffico V4-Pro e offre tariffe inferiori a quelle dei modelli di frontiera per l’input in cache.
- Disney nomina l’amministratore delegato di Character.AI primo direttore tecnologico a livello aziendale
Disney ha nominato Karandeep Anand, amministratore delegato uscente di Character.AI, primo direttore tecnologico a livello aziendale. Anand supervisionerà tecnologia aziendale, dati, piattaforme di IA, prodotti e ingegneria a partire dal 2 ottobre.
- Shanghai AI Lab rilascia Atria Dawn, modello agentico da 753 miliardi di parametri
Atria Dawn Preview dello Shanghai Artificial Intelligence Laboratory è un modello agentico da 753 miliardi di parametri, distribuito con licenza MIT, con una finestra di contesto da 256K token e opzioni per l’esecuzione in locale.
- Salesforce presenta Koa, un modello CRM per Agentforce
Salesforce presenta Koa, un modello di ragionamento CRM basato su NVIDIA Nemotron per gli agenti Agentforce. L’azienda afferma che Koa migliora la selezione delle azioni, la conservazione del contesto e l’affidabilità, ma i risultati pubblicati provengono dal CRM Bench sviluppato da Salesforce stessa.
- Zendesk lancia agenti IA settoriali e personalizzati per i flussi di lavoro aziendali
Zendesk ha presentato agenti IA settoriali e personalizzati, progettati per gestire flussi di lavoro specializzati nel commercio e nelle attività aziendali, operando su sistemi connessi.
- Iambic presenta Enchant v3 da 41 miliardi di parametri per la scoperta di farmaci
Iambic ha annunciato Enchant v3, un transformer multimodale da 41 miliardi di parametri progettato per la ricerca e lo sviluppo di farmaci end-to-end. L’azienda afferma che il modello aggiunge nuove capacità di previsione e supporta i suoi programmi di ricerca interni e in collaborazione con partner.
- OpenAI porta i flussi di lavoro controllati a voce su ChatGPT per dispositivi mobili
OpenAI porta nell’app mobile di ChatGPT flussi di lavoro agentici basati sulla voce, consentendo agli abbonati Plus e Pro di creare documenti, preparare bozze di email, riassumere messaggi Slack e realizzare presentazioni parlando. Gli utenti Free e Go potranno usare la voce con plugin e app collegate, mentre le conversazioni potranno passare da dispositivi mobili a computer desktop.
- OpenAI porta GPT-Rosalind al lancio globale nel settore delle scienze della vita
OpenAI ha fatto uscire GPT-Rosalind dall’anteprima di ricerca e ha reso il modello per le scienze della vita disponibile a livello globale alle organizzazioni idonee tramite il suo programma di accesso affidabile. Il modello supporta attività di biologia, genomica, scoperta di farmaci, analisi delle proteine e pianificazione degli esperimenti tramite ChatGPT, Codex e l’API.
- Fujitsu avvia a novembre le vendite della CPU MONAKA e del server per l’IA sovrana
Fujitsu prevede di avviare a novembre 2026 le vendite del processore FUJITSU-MONAKA e del MONAKA Server, con spedizioni più ampie in Giappone e in Europa a partire da aprile 2027.
- Edge0 serve un MoE da 35B a 20 token al secondo in 3 GiB
I ricercatori dietro Edge0 descrivono un motore di inferenza che esegue un modello mixture-of-experts da 35 miliardi di parametri, archiviato su SSD, a 20,4 token al secondo. Il sistema usa 2,9 GiB di memoria attiva di picco su una macchina Apple Silicon con 24 GB, prevedendo il routing degli esperti con un token di anticipo.
- Meta porta Muse sugli occhiali con IA e amplia la gamma Ray-Ban
Meta annuncia l’arrivo di Muse sui suoi occhiali con IA, insieme ai nuovi modelli Ray-Ban Audio e Gen 3.
- La Spagna definisce un piano di 12 mesi per un’implementazione responsabile dell’IA
La Spagna ha presentato Plan IA360, una tabella di marcia di 12 mesi che combina infrastrutture per l’IA, adozione da parte delle imprese, istruzione e controlli più rigorosi. Il primo ministro Pedro Sánchez ha anche invocato un contratto sociale nazionale che affronti gli effetti dell’IA sul lavoro, sulla sicurezza e sulla vita pubblica.
- PA Consulting entra nella coalizione di Cosine per un modello di IA nucleare britannico
PA Consulting entra nella coalizione di Cosine per co-progettare Lumen Sovereign, un modello di IA di frontiera britannico destinato ai settori regolamentati. La prima applicazione prevista è un modello linguistico di grandi dimensioni addestrato sul settore nucleare, per i comparti nucleari civile e della difesa del Regno Unito.
- Anthropic trasforma i progetti di Claude Code in workspace multi-agente
Anthropic sta trasformando Claude Projects: da luogo in cui raccogliere conversazioni a workspace capace di assegnare e gestire attività di sviluppo software su più sessioni di Claude Code.
- OpenAI propone all’Australia un piano in sei punti per la sicurezza degli adolescenti
OpenAI chiede all’Australia di adottare norme flessibili, basate sul rischio, per la sicurezza degli adolescenti nell’uso dell’IA, attraverso un piano in sei pilastri che riguarda la verifica dell’età, le risposte dannose, la gestione delle crisi e i controlli parentali.
- Alibaba rilascia Qwen3.8-Omni-Flash con un contesto da 1 milione di token
Il team Qwen di Alibaba ha rilasciato Qwen3.8-Omni-Flash, un modello multimodale che accetta testo, immagini, audio e video. Il modello supporta una finestra di contesto da 1 milione di token, chiamate agli strumenti, ricerca sul web e input audio in 113 lingue e dialetti.
- Baselayer raccoglie 35 milioni di dollari per verificare gli agenti di IA nel commercio
Baselayer ha raccolto 35 milioni di dollari in un round di Serie A guidato da M13 e ha lanciato la sua Agentic Identity Suite, destinata ai software che agiscono per conto di persone e imprese.
- Schatz e Warner chiedono controlli sull’IA 45 giorni prima del rilascio
I senatori statunitensi Brian Schatz e Mark Warner hanno presentato un disegno di legge che impone agli sviluppatori di modelli di IA di frontiera di dare accesso ai modelli a un organo federale proposto 45 giorni prima del rilascio. Il disegno di legge sostituirebbe il quadro di revisione volontaria della Casa Bianca con standard vincolanti e sanzioni.
- Il sistema giudiziario statunitense ai tribunali: non delegate le decisioni all’IA
La Conferenza giudiziaria afferma che i tribunali federali non devono affidare all’intelligenza artificiale le funzioni giudiziarie essenziali, compresa la decisione delle cause. Le linee guida provvisorie stabiliscono inoltre che giudici e personale dei tribunali restano responsabili del lavoro prodotto con l’assistenza dell’IA.
- Jensen Huang respinge nuove leggi sull’IA mentre si allarga il dibattito sulla sicurezza
Secondo TechCrunch, il CEO di Nvidia Jensen Huang ha detto ai partecipanti alla conferenza Dreamforce di Salesforce che la sicurezza dell’IA dovrebbe essere gestita attraverso l’ingegneria, le leggi esistenti e le decisioni delle aziende, anziché con nuove normative.
- SoundHound porta gli agenti vocali OASYS sui dispositivi edge
SoundHound ha annunciato OASYS Edge, un sistema per distribuire agenti vocali sui veicoli e sui dispositivi intelligenti, oltre che nel cloud. L’azienda afferma che l’elaborazione locale può consentire ad alcune interazioni selezionate di continuare a funzionare senza connessione di rete. Il lancio è previsto per la fine del 2026.
- Il Goncourt esclude il romanzo di Thélyson Orélien dopo le accuse sull’uso dell’IA
L’Académie Goncourt ha escluso il romanzo di Thélyson Orélien dalla prima selezione, citando accuse di plagio e analisi secondo cui sarebbe con ogni probabilità in gran parte generato dall’IA. Orélien nega di aver usato l’IA, mentre i risultati contrastanti dei sistemi di rilevamento e le accuse di plagio restano oggetto di contestazione.
- SoftBank cerca oltre 11 miliardi di dollari in obbligazioni spazzatura per puntare su OpenAI
Bloomberg News ha riferito che SoftBank sta cercando di raccogliere più di 11 miliardi di dollari con obbligazioni spazzatura per finanziare un ulteriore investimento in OpenAI.
- UpGuard individua 16.326 database Supabase con tabelle leggibili
UpGuard afferma di aver individuato 16.326 database Supabase con tabelle leggibili dopo aver esaminato circa 300.000 domini alla ricerca di dati esposti. I suoi ricercatori hanno identificato indicatori di schema riconducibili a informazioni personali in più della metà dei database e verificato diverse esposizioni gravi, tra cui messaggi privati, dati identificativi e password.
- Humyn Labs mette alla prova 23 modelli ASR con il parlato sovrapposto
Il benchmark BRIDGE ASR 2.0 di Humyn Labs valuta 23 modelli commerciali di riconoscimento vocale su conversazioni spontanee con parlato sovrapposto, in 21 lingue e secondo sei metriche.
- Z.ai disattiva le funzionalità di ZCode dopo le segnalazioni di caricamenti di codice
La startup cinese di IA Z.ai ha disattivato alcune funzionalità del suo assistente di programmazione ZCode dopo che alcuni sviluppatori hanno segnalato che caricava repository di codice locali su server cloud all’estero senza consenso.
- I senatori incalzano Flock sulla rete di sorveglianza e le garanzie per la privacy
Il 23 settembre, una sottocommissione della Commissione Giustizia del Senato ha ascoltato preoccupazioni bipartisan sulla rete di telecamere per il riconoscimento delle targhe di Flock Safety. La testimone Lindsey Isaacs ha raccontato di aver trascorso 13 giorni in carcere dopo che la ripresa di una telecamera Flock era entrata a far parte di un’indagine basata su un errore.
- Anthropic e OpenEvidence portano l’IA clinica in circa 100 Paesi
Anthropic e OpenEvidence stanno introducendo un servizio gratuito di supporto alle decisioni cliniche per gli operatori sanitari in circa 100 Paesi. OpenEvidence adatterà il servizio alle condizioni regionali, mentre Anthropic fornirà la tecnologia di backend.
- Payhawk lancia Playbook agentici per i processi finanziari
Payhawk ha lanciato Playbook agentici per le attività finanziarie ricorrenti all’interno di Claude, ChatGPT e della propria piattaforma, insieme a un nuovo Implementation Agent per l’avvio dei nuovi clienti.
- Il chip per l’IA di Architect Labs deve ancora dimostrare il proprio valore sul silicio
Architect Labs afferma che il suo sistema di IA ha progettato e verificato l’acceleratore per l’inferenza Redwood in meno di due settimane, partendo da una specifica scritta da due architetti umani. Attualmente Redwood funziona su un FPGA, mentre l’azienda prevede che, una volta fabbricato, offrirà prestazioni superiori e consumi inferiori rispetto a Jetson Orin Nano di Nvidia.
- The Seattle Times e Newsday fanno causa a OpenAI e Microsoft per l’addestramento dell’IA
The Seattle Times e Newsday hanno intentato una causa federale contro OpenAI e Microsoft, accusandole di aver copiato i loro articoli per addestrare e far funzionare prodotti di IA. Gli editori chiedono un risarcimento e un provvedimento riguardante copie, dataset e modelli che, secondo loro, violano il diritto d’autore.
- Meta consente agli agenti di IA di configurare account WhatsApp Business
Meta ha presentato WhatsApp Business Tools MCP, che collega Claude, Cursor, Codex e ChatGPT alle procedure di configurazione di WhatsApp Business. Il sistema può creare account, verificare numeri di telefono, gestire modelli e testare webhook tramite un agente di IA autenticato.
- Mozilla: i modelli di IA aperti sono indietro di soli 4,4 mesi
Secondo il rapporto State of Open Source AI di Mozilla, i principali modelli a pesi aperti sono indietro di circa 4,4 mesi rispetto ai sistemi chiusi, ma costano meno per molte attività.
- Il benchmark Eon rileva che gli agenti aziendali non colgono i fatti nascosti
I ricercatori di Eon hanno testato 12 configurazioni di agenti aziendali con domande che richiedevano di dedurre fatti da documenti aziendali simulati. La configurazione migliore ha risposto correttamente a 18 tentativi su 24, mentre le domande su documenti simili hanno messo in difficoltà quasi tutti gli agenti.