OpenAI ha presentato GPT-Live, una nuova nuova generazione di modelli vocali che permette di chiacchierare con l’IA con modalità molto più naturali e fluide.
GPT-Live, spiega OpenAI, sfrutta un’architettura full-duplex che, in altre parole, permette di ascoltare e parlare contemporaneamente. Durante le conversazioni, GPT-Live può dimostrare di prestare attenzione con espressioni come “mhmm” o “sì”, interagire con rapidi scambi di battute o semplicemente rimanere in silenzio quando l’utente ha bisogno di un momento per pensare. “Il risultato”, promette OpenAI, “è un’esperienza vocale incredibilmente spontanea e facile con cui interagire”.
GPT-Live è presentato come il modello di OpenAI “più intelligente di sempre”. “Per le domande che richiedono una ricerca sul web, un ragionamento più profondo o un lavoro più complesso, delega dietro le quinte al nostro modello di frontiera più recente e riporta il risultato nella conversazione non appena è pronto. Mentre elabora, GPT-Live può continuare a parlare con te e mantenere il flusso della conversazione. Al lancio, GPT-Live utilizzerà GPT-5.5 in background. Man mano che rilasceremo nuovi modelli di frontiera, aggiorneremo continuamente il modello utilizzato da GPT-Live”.
OpenAI parla di “una nuova esperienza vocale” con ChatGPT, ora indicato come “iù intelligente e naturale da usare. “Con il tempo, crediamo che questa ricerca sbloccherà anche la capacità di utilizzare la voce per attività sempre più complesse, a lungo termine e di natura agentica”.
È stato avviato il rollout di due versioni di GPT-Live – GPT-Live-1 e GPT-Live-1 mini – agli utenti di ChatGPT a livello globale e OpenAI prevede di renderle presto disponibili tramite API (per sviluppatori e aziende).
Una nuova esperienza vocale con ChatGPT
“Oni settimana, più di 150 milioni di persone parlano con ChatGPT utilizzando funzionalità come la Modalità Vocale e la Dettatura”, spiega OpenAI. “Lo usano per ricevere aiuto a mani libere nella vita di tutti i giorni, per fare pratica con le lingue, raccontare storie della buonanotte o semplicemente per chiacchierare durante il tragitto casa-lavoro”.
Parlare con ChatGPT ora dovrebbe essere molto più simile a una conversazione reale.È possibile interrompere e porre domande, fare una pausa per raccogliere i pensieri o chiedere a ChatGPT di parlare più lentamente. “Se le chiedi di rimanere in silenzio e ascoltare, lo farà. E in presenza di rumori di sottofondo, come il traffico di passaggio o conversazioni vicine, ChatGPT riesce a concentrarsi meglio sulla voce dell’utente senza distrarsi”.
ChatGPT ora è in grado di mostrare schede visive dettagliate per argomenti come meteo, borsa, sport e altro. La Modalità Vocale continua inoltre a supportare la ricerca sul web, la memoria, le immagini e il caricamento di file.
Sicurezza
OpenAI ha previsto misure di sicurezza: quando il sistema rileva un output potenzialmente non sicuro, può indirizzare il modello verso una risposta più sicura, mostrare messaggi o risorse di sicurezza aggiuntive o interrompere la conversazione vocale nei casi a più alto rischio. Per le conversazioni che, ad esempio, fanno riferimento all’autolesionismo, sono state previste misure come inviato all’assistenza certificate da esperti. Sono state predisposte ulteriori protezioni per tutelare gli adolescenti e addestrato il modello a comportarsi in modo adeguato all’età, per ridurre il rischio di risposte inappropriate. I genitori possono scegliere se consentire ai propri figli adolescenti di utilizzare la Modalità Vocale di ChatGPT tramite il Parental Control, e i genitori con account collegati potrebbero ricevere una notifica in situazioni a maggior rischio che presentino segnali di potenziale autolesionismo o altri problemi.
Tutte le notizie e gli approfondimenti sull’intelligenza artificiale sono disponibili nella sezione dedicata di macitynet.












