Vai al contenuto
AI.info

The Pulse

OpenAI porta i flussi di lavoro controllati a voce su ChatGPT per dispositivi mobili

OpenAI porta nell’app mobile di ChatGPT flussi di lavoro agentici basati sulla voce, consentendo agli abbonati Plus e Pro di creare documenti, preparare bozze di email, riassumere messaggi Slack e realizzare presentazioni parlando. Gli uten

OpenAI porta i flussi di lavoro controllati a voce su ChatGPT per dispositivi mobili

AI.info Team ·

150 milioni di utenti settimanali della voce avranno un ChatGPT più capace

Secondo OpenAI, oltre 150 milioni di persone usano ogni settimana le funzioni Voce e Dettatura di ChatGPT. Il 23 settembre l’azienda ha iniziato a estendere l’uso della voce dalla conversazione alle attività di lavoro su dispositivi mobili, consentendo agli utenti di chiedere a ChatGPT di creare documenti, preparare bozze di email e riassumere messaggi Slack tramite l’app per telefono.

Con il lancio, ChatGPT Work arriva nelle conversazioni vocali da dispositivi mobili per gli abbonati Plus e Pro. Gli utenti possono anche chiedere al sistema di creare siti, realizzare presentazioni, usare il browser cloud e lavorare in aree come Finanze all’interno di ChatGPT. L’annuncio di OpenAI è stato riportato per la prima volta da TechCrunch.

Il cambiamento è significativo perché finora la versione per telefono di ChatGPT offriva un’esperienza vocale relativamente limitata: gli utenti potevano parlare con l’assistente, ma l’interfaccia vocale non era progettata per avviare attività complesse sul dispositivo. Ora OpenAI collega questo livello conversazionale ai flussi di lavoro più lunghi già disponibili tramite ChatGPT Work.

Plus e Pro ottengono l’intera scheda Work

Gli abbonati a pagamento possono usare la scheda Work su dispositivi mobili per affidare attività in più passaggi tramite comandi vocali. Una richiesta pronunciata potrebbe chiedere a ChatGPT di trasformare del materiale di partenza in un documento, preparare una presentazione, riassumere una conversazione su Slack o scrivere una bozza di email. L’utente può poi proseguire lo scambio a voce o consultare il risultato scritto nell’app.

OpenAI afferma anche che gli utenti Plus possono passare dal testo alla voce durante una conversazione. È utile per le attività in cui si vuole dettare l’istruzione iniziale, ma poi esaminare o modificare visivamente il risultato. Secondo l’annuncio dell’azienda, è anche possibile riprendere su un computer desktop una conversazione iniziata lontano dalla propria postazione di lavoro.

Gli utenti Free e Go ricevono una versione più limitata dell’aggiornamento. Possono usare la voce con i plugin supportati e le app collegate, ma TechCrunch riferisce che la scheda Work completa resta riservata agli abbonati Plus e Pro.

GPT-Live collega la conversazione ad attività più complesse

Il lancio su dispositivi mobili si basa su GPT-Live, la famiglia di modelli vocali di OpenAI presentata a luglio. OpenAI descrive GPT-Live come un sistema full-duplex, capace di ascoltare e parlare contemporaneamente, delegando nel frattempo ricerca, ragionamento e attività più impegnative ad altri modelli in background. L’azienda afferma che questa architettura consente di mantenere attiva la sessione vocale mentre si svolgono attività più complesse.

Nell’annuncio di GPT-Live, OpenAI afferma che il modello può decidere se continuare ad ascoltare, fare una pausa, interrompere o richiamare uno strumento. L’azienda ha inoltre riferito che oltre 150 milioni di persone usano ogni settimana Voce e Dettatura, anche se questa cifra comprende entrambe le funzioni e non soltanto le conversazioni vocali.

All’inizio di settembre ChatGPT Voice ha ottenuto accesso a modelli di ragionamento più potenti. Le note di rilascio di OpenAI affermano che Voice può usare GPT-5.6 o GPT-6 Astra quando una richiesta richiede una ricerca o un ragionamento più approfondito; la disponibilità e i limiti di utilizzo dipendono dal piano dell’utente.

Il lancio su dispositivi mobili estende quello iniziato su desktop

A luglio OpenAI aveva collegato per la prima volta la voce a ChatGPT Work e Codex nell’app desktop. L’aggiornamento consentiva agli utenti di impartire comandi complessi, verificare i progressi degli agenti e coordinare più agenti tramite istruzioni vocali. In un esempio riportato da TechCrunch, un utente ha chiesto a ChatGPT con un unico comando di creare una discussione, aprire una pull request e indagare su un bug software.

Il lancio su desktop aveva inoltre mostrato il confine tra conversazione vocale e controllo del computer. ChatGPT poteva usare le funzionalità di utilizzo del computer per esaminare siti web e applicazioni, mentre Codex poteva continuare a lavorare da remoto tramite un dispositivo iOS. Con l’aggiornamento del 23 settembre, una parte maggiore del flusso di lavoro si sposta sul telefono, che non funge più soltanto da telecomando.

OpenAI non sta unificando Chat e Work in un’unica interfaccia. TechCrunch riferisce che l’azienda manterrà separate le due aree, anche se ora la voce può accedere a Work da dispositivi mobili. Questa distinzione offre agli utenti uno spazio dedicato alle attività più lunghe, preservando al contempo la modalità di conversazione tradizionale di ChatGPT per domande e risposte rapide.

Il telefono diventa il punto di partenza, non l’intero spazio di lavoro

La voce è utile per avviare un’attività quando digitare è scomodo, ma la nuova funzione dipende ancora da un’interfaccia scritta per controllare i risultati e gestire i dettagli. Si può iniziare senza usare le mani a preparare una bozza di email o chiedere un riepilogo; approvare un’azione, correggere un nome o rivedere una presentazione può comunque richiedere un’attenta verifica visiva.

Il passaggio al dispositivo mobile solleva anche questioni pratiche relative alle autorizzazioni. Work può usare app e file collegati solo nei limiti degli accessi concessi all’account, e le attività che comportano azioni sensibili possono richiedere una conferma. I materiali più ampi di OpenAI su ChatGPT Work descrivono un sistema capace di operare con app e file collegati, consentendo agli utenti di seguire i progressi, cambiare direzione e approvare le azioni importanti.

Per ora, il cambiamento concreto è semplice: gli utenti Plus e Pro possono avviare con la voce attività di ChatGPT Work sul telefono, mentre gli utenti Free e Go ottengono l’accesso vocale ai plugin supportati e alle app collegate. La prossima prova sarà capire se le persone useranno abbastanza spesso la voce sui dispositivi mobili per avviare attività di una certa portata da giustificare le autorizzazioni aggiuntive, i limiti legati agli abbonamenti e i passaggi di revisione che ne conseguono.

Fonti

Esplora

Altri articoli