AI.info
The Pulse — Page 6
Sfoglia The Pulse su AI.info.
In inglese
- Anthropic rende open source le ottimizzazioni di Claude per i modelli biologici
Secondo Anthropic, Claude ha ottimizzato oltre 30 modelli open source usati nella ricerca biomolecolare, rendendoli in media circa quattro volte più veloci e riducendo l’uso di memoria per i grandi sistemi molecolari.
- RoboHarm verifica se le politiche di controllo dei robot rifiutano i comandi pericolosi
Robocurve ha pubblicato RoboHarm, un benchmark di cinque prove per verificare se le politiche di controllo dei robot rifiutano istruzioni fisicamente pericolose. Il benchmark valuta Claude Fable 5.1, GPT-6 Astra e MolmoAct2 in 300 tentativi che coinvolgono lame, calore, elettricità, batterie e prodotti chimici domestici.
- La centratura dello score mantiene stabile l’apprendimento per rinforzo dei LLM al 30% sotto stress INT4
Un nuovo studio di Together AI individua nell’accumulo di deriva una delle principali cause di instabilità nell’apprendimento per rinforzo dei modelli linguistici di grandi dimensioni. Con il metodo di centratura dello score, l’accuratezza in addestramento raggiunge il 30% in condizioni di forte quantizzazione del campionatore, contro il 12% ottenuto con il campionamento per importanza troncato.
- Liquid AI aggiunge la decodifica DSpark a LFM2.5-VL-3B
Un articolo del team di Liquid AI descrive un modello draft sperimentale per velocizzare la decodifica.
- OpenAI taglia i prezzi API di GPT-6 Sol e Luna; il prezzo dei token di output di Luna scende del 58,3%
OpenAI ha presentato GPT-6 Sol e GPT-6 Luna con prezzi API più bassi, risultati solidi nei test sui flussi di lavoro, sulla programmazione e sull’uso del computer, e disponibilità in ChatGPT Work, Codex e nell’API.
- Huawei rafforza la sua offensiva sui chip Ascend contro Nvidia
Huawei ha presentato Atlas 960 SuperPoD e delineato un piano pluriennale per i chip Ascend durante la sua conferenza a Shanghai. L’azienda punta a sfidare Nvidia con sistemi di IA più grandi, hardware nazionale e una nuova tecnologia di interconnessione.
- Kastle raccoglie 24 milioni di dollari per portare lavoratori di IA nei sistemi di erogazione dei prestiti
Kastle raccoglie 24 milioni di dollari in un round di Serie A guidato da Insight Partners per ampliare la sua piattaforma di forza lavoro basata sull’IA per banche e finanziarie. L’azienda afferma che i suoi agenti hanno elaborato transazioni per oltre 1,8 miliardi di dollari operando sui sistemi di erogazione dei prestiti già in uso.
- Ema raccoglie 77 milioni di dollari per contrapporre gli agenti IA al software aziendale
Ema ha raccolto 77 milioni di dollari in un round di serie B guidato da Creaegis per estendere l’impiego degli agenti IA nei flussi di lavoro aziendali delle risorse umane, dell’IT e della finanza. La startup di Mountain View afferma di aver raggiunto 140 milioni di dollari di finanziamenti complessivi mentre si prepara a entrare nei mercati dell’Asia-Pacifico, del Sud America e del Medio Oriente.
- OpenAI lancia il modello vocale GPT-Live-1 nella sua API
OpenAI ha rilasciato GPT-Live-1 nella sua API, offrendo agli sviluppatori un modello vocale full-duplex capace di ascoltare e parlare contemporaneamente. Il modello supporta la gestione delle interruzioni, la telefonia, il ragionamento delegato e un costo di 0,05 dollari al minuto per la voce front-end.
- Gli agenti di IA spesso non riescono a coordinarsi autonomamente, secondo un nuovo studio su arXiv
Un nuovo preprint su arXiv sostiene che, quando operano oltre i confini di fiducia, gli agenti di IA autonomi hanno bisogno di regole condivise per la comunicazione, l’identità, la convalida dei messaggi e l’attribuzione delle responsabilità.
- Redwood rileva miglioramenti di GPT-6 Astra grazie ai token riempitivi
Redwood Research riferisce che GPT-6 Astra risponde con maggiore precisione ad alcuni compiti di ragionamento quando i prompt contengono token riempitivi privi di significato. I ricercatori avvertono che questi miglioramenti sollevano interrogativi su come valutare un ragionamento che non compare nella spiegazione scritta del modello.
- Qualcomm porta modelli di IA da 30B di parametri sui suoi nuovi chip per smartphone
Qualcomm ha presentato le piattaforme per smartphone Snapdragon 8 Elite Extreme Gen 6 e Snapdragon 8 Elite Gen 6. Il modello Extreme è progettato per eseguire localmente modelli mixture-of-experts da 30 miliardi di parametri, mentre entrambi i chip integrano nuovo hardware per agenti personali di IA, fotocamere, gaming e connettività.
- Il Pentagono chiede 6,4 milioni di dollari per avviare un poligrafo valutato dall’IA
La richiesta di bilancio per l’esercizio finanziario 2027 della Defense Counterintelligence and Security Agency prevede 6,421 milioni di dollari per avviare Polygraph Next, un programma volto a modernizzare i test del poligrafo con sensori senza contatto e valutazioni basate sull’IA, e stanzia in previsione 30,342 milioni di dollari fino al 2031. La promessa di valutazioni dell’attendibilità più accurate si scontra con una consolidata preoccupazione scientifica: le risposte fisiologiche non indicano in modo univoco l’inganno.
- Fastly aggiunge controlli runtime per gli agenti di IA aziendali
Fastly lancia AI Runtime Control, AI Firewall e funzionalità di API Security per i sistemi di IA aziendali. I prodotti offrono controlli centralizzati sull’accesso ai modelli, sulla spesa, sulla difesa dagli attacchi di prompt injection e sulle richieste degli agenti alle API aziendali.
- TypeSafe lancia Jev per decisioni rapide e strutturate dell’IA
TypeSafe AI ha rilasciato Jev, un modello in accesso anticipato progettato per restituire decisioni strutturate e probabilistiche anziché testo generato. L’azienda afferma che Jev offre tempi di risposta da 70 a 500 millisecondi e può costare fino a 444,6 volte meno rispetto a flussi di lavoro comparabili basati su modelli linguistici di grandi dimensioni.
- Dario Amodei chiede di rallentare la corsa all’IA di frontiera
Il CEO di Anthropic Dario Amodei chiede alle aziende che sviluppano IA di frontiera di rallentare il miglioramento delle capacità e di dare più tempo alla ricerca sulla sicurezza. La sua proposta in tre punti prevede valutatori esterni integrati nelle aziende, coordinamento tra governi democratici e accordi globali sullo sviluppo di IA pericolose.
- Mistral e Cloudera portano l’IA sovrana su 30 exabyte di dati
Mistral e Cloudera collaborano per gestire e personalizzare l’IA in ambienti privati, pubblici, on-premise, edge, sovrani e isolati dalla rete. Le aziende affermano che i clienti potranno addestrare modelli sui propri dati, mantenendo il controllo sulle informazioni, sull’infrastruttura e sull’intelligenza generata.
- JADEPUFFER: ransomware agentico per l’estorsione automatizzata ai danni dei database
Sysdig descrive JADEPUFFER come il primo caso documentato di ransomware agentico, in cui un LLM ha guidato la ricognizione, la raccolta di credenziali, il movimento laterale e le azioni distruttive sui database.
- Databricks estende Astra a tutti gli ingegneri
Databricks ha esteso Astra a circa 3.500 ingegneri dopo un progetto pilota con circa 200 utenti, usando controlli di budget per orientare la scelta dei modelli e la spesa.
- La falla zero-day di Meta in Muse permette alle app locali di prendere il controllo dell’assistente IA
Una falla zero-day in macOS permette alle app in esecuzione locale e ai comandi da terminale di reindirizzare l’endpoint di trascrizione di Muse, esponendo il token che controlla l’assistente IA e i suoi ampi privilegi.
- GPT-5.6 Sol completa 36 delle 40 misurazioni previste dei qubit in autonomia
OpenAI afferma che GPT-5.6 Sol, eseguito tramite Codex, ha completato 36 delle 40 misurazioni previste su un chip a sei qubit mai calibrato prima, con appena quattro interventi dei ricercatori. L’esperimento del MIT mostra in quali ambiti gli agenti di IA possono gestire la calibrazione quantistica di routine e in quali, invece, i dati rumorosi e ambigui richiedono ancora il giudizio degli esperti.
- Fulcrum lancia strumenti MCP per creare flussi di lavoro sul campo con l’IA
Fulcrum ha lanciato un server MCP e AI Toolkit che consentono ai team sul campo di creare e gestire flussi di lavoro tramite istruzioni in linguaggio naturale. Gli strumenti, disponibili in versione preliminare, sono rivolti a società di servizi pubblici, studi di ingegneria, imprese edili e team di ispezione che utilizzano la piattaforma Field Operations Management di Fulcrum.
- OpenAI mette il miglioramento ricorsivo di sé al primo posto per gli agenti di IA
Noam Brown, ricercatore di OpenAI, afferma che la priorità principale dell’azienda per gli agenti di IA è automatizzare la ricerca e lo sviluppo nell’IA. La strategia anteporrebbe il miglioramento ricorsivo di sé a impieghi più circoscritti, come l’ingegneria del software, l’automazione aziendale e gli assistenti digitali.
- OpenAI lancia ChatGPT for Financial Services con dati integrati
OpenAI ha presentato ChatGPT for Financial Services, un prodotto aziendale su misura per la ricerca finanziaria, la modellizzazione e la preparazione di materiali per i clienti. Il servizio combina GPT-6 Astra con dati di fornitori tra cui Daloopa, PitchBook, LSEG News e Crunchbase.
- OpenAI porta ChatGPT for Word su tutti i piani ChatGPT
ChatGPT for Word è disponibile su tutti i piani ChatGPT, compreso Free, e offre strumenti integrati in Microsoft Word per redigere, modificare e formattare documenti e farne una sintesi.
- I Paesi Bassi assegnano a Groningen la sede del supercomputer di IA da 201 milioni di euro
I Paesi Bassi installeranno il loro supercomputer nazionale di IA nel data center di Eurofiber presso il campus Zernike di Groningen. Il progetto da 201 milioni di euro dovrebbe essere completato nel 2027; il sistema dovrebbe entrare pienamente in funzione all’inizio del 2028.
- Multiverse Computing elimina metà di Llama 3.3 con il 77% a MMLU
Multiverse Computing presenta un metodo basato sulla fisica per rimuovere blocchi transformer dai modelli linguistici di grandi dimensioni. Il suo approccio ottiene il 76,9% a MMLU dopo aver eliminato 40 degli 80 blocchi di Llama 3.3 70B Instruct, superando di 22,9 punti un metodo di riferimento di primo piano.
- Sam Altman esclude una quotazione in borsa di OpenAI nel 2026
Il CEO di OpenAI, Sam Altman, ha detto che nel 2026 la società non procederà a un’offerta pubblica iniziale, citando il lavoro da svolgere in materia di sicurezza, allineamento e supervisione.
- L’UE avvia le richieste ai sensi dell’AI Act, ma la Commissione tiene segreti i destinatari
La Commissione europea afferma di aver iniziato a esercitare i poteri di applicazione previsti dall’AI Act dell’UE, ma i funzionari non hanno voluto indicare le aziende che hanno ricevuto le prime richieste di informazioni.
- Base Labs collabora con Hugging Face e Goodfire sulla sicurezza dei modelli open
Base Labs collabora con Hugging Face e Goodfire AI allo sviluppo di infrastrutture per la valutazione e il monitoraggio della sicurezza dei modelli a pesi aperti.
- Neuralink mostra la ricostruzione della voce dal pensiero alla parola nel trial VOICE
Neuralink ha mostrato il partecipante Terry mentre usa un’interfaccia cervello-computer impiantata per produrre parole pronunciate a partire dal linguaggio che intendeva esprimere. L’azienda afferma che il trial VOICE combina la decodifica neurale con Grok Voice per ricreare la voce naturale del partecipante.
- Microsoft fa di Hyderabad il suo polo dell’IA per l’India e il Sud globale
Microsoft ha designato la sua regione cloud India South Central, a Hyderabad, come polo strategico per l’Asia e il Sud globale. Secondo l’azienda, le sue quattro regioni cloud indiane dispongono ora di infrastrutture pronte per l’IA, mentre la nuova regione offre resilienza su tre zone, controlli locali sui dati e supporto per carichi di lavoro avanzati.
- Databricks acquisisce Row Zero per aggiungere i fogli di calcolo a Genie
Databricks afferma che l’acquisizione di Row Zero porterà a Genie un’esperienza di foglio di calcolo governata, collegando l’analisi tramite fogli di calcolo ai dati in tempo reale.
- Mistral raccoglie 3 miliardi di euro per costruire un’infrastruttura sovrana per l’IA in Europa
Mistral AI ha raccolto 3 miliardi di euro in un round di serie D guidato da Samsung, raggiungendo una valutazione superiore a 21 miliardi di euro. La società francese userà i fondi per ampliare la ricerca sui modelli di frontiera, la capacità di calcolo, le infrastrutture e le attività rivolte alle imprese sui mercati internazionali.
- I ricercatori di Apple rendono più selettiva la regolazione delle attivazioni degli LLM
I ricercatori di Apple presentano Dynamically Scaled Activation Steering, un metodo che regola l’intensità dell’intervento token per token, invece di applicare un’unica impostazione globale. I test su Qwen 2.5 e Gemma 2 mostrano una minore tossicità e perdite più contenute nelle prestazioni dei modelli linguistici.
- Skild AI insegna ai robot nuovi compiti a partire da un solo video con NVIDIA
Skild AI afferma che il suo modello di base per la robotica S1 può imparare compiti sconosciuti e articolati in più fasi da un solo video, senza essere riaddestrato. Il modello usa NVIDIA Cosmos, Isaac Lab, Omniverse e TensorRT per la generazione dei dati, la simulazione, l’addestramento e l’impiego operativo.
- Bessemer raccoglie 5,75 miliardi di dollari per finanziare startup di IA, dal seed alla crescita
Bessemer Venture Partners ha chiuso la raccolta di 5,75 miliardi di dollari attraverso nuovi fondi seed, early-stage e growth. La società destinerà 4 miliardi di dollari agli investimenti in fase di crescita e 1,75 miliardi di dollari alle startup più giovani attive nei diversi ambiti dello stack dell’IA.
- Musk ritira le accuse contro Apple e prosegue la causa antitrust contro OpenAI
X Corp. e SpaceXAI chiedono a un tribunale federale del Texas di archiviare le loro accuse antitrust contro Apple dopo aver risolto la controversia. Le società mantengono invece le accuse contro OpenAI relative all’integrazione di ChatGPT nelle funzioni dell’iPhone da parte di Apple.
- OpenAI dà all’Ucraina accesso a Daybreak per la difesa informatica civile
OpenAI estende al governo ucraino il suo programma di cybersicurezza Daybreak per contribuire a proteggere le infrastrutture civili. L’iniziativa sosterrà l’individuazione delle vulnerabilità, l’analisi del software e la verifica delle correzioni di sicurezza, in un contesto in cui CERT-UA ha gestito quasi 6.000 incidenti informatici nel 2025.
- I governi australiani adottano un quadro nazionale per la valutazione dell’IA
I governi del Commonwealth, degli Stati e dei Territori hanno concordato un quadro nazionale per valutare l’intelligenza artificiale nei servizi pubblici, definendo aspettative comuni per lo sviluppo, l’acquisto, l’impiego e la supervisione dei sistemi.