GPT-Live rivoluziona la voce di ChatGPT con dialoghi più naturali

OpenAI ha presentato GPT-Live, una nuova generazione di modelli vocali progettata per rendere le conversazioni con ChatGPT molto più naturali, immediate e simili a un dialogo tra persone. La novità è già in fase di distribuzione all’interno della modalità Conversazione e introduce un cambiamento profondo nel modo in cui l’intelligenza artificiale ascolta, interpreta e risponde alla voce degli utenti.
Il cuore del nuovo sistema è un’architettura full-duplex, capace di gestire ascolto e risposta nello stesso momento. In precedenza, l’interazione vocale seguiva soprattutto una sequenza rigida: prima parlava l’utente, poi il modello elaborava la richiesta e infine forniva la risposta. Con GPT-Live, invece, l’IA continua ad analizzare l’audio mentre la conversazione è in corso e può adattare il proprio comportamento in tempo reale.
Questo approccio permette al modello di capire meglio quando intervenire, quando restare in ascolto e quando lasciare spazio a una pausa. GPT-Live può attendere che l’interlocutore completi un ragionamento senza interromperlo e, quando opportuno, utilizzare brevi segnali vocali di conferma per far percepire che sta seguendo il discorso.

Una conversazione continua, anche durante le richieste complesse
La nuova esperienza non si limita a rendere più fluido lo scambio di battute. GPT-Live è stato sviluppato per mantenere attiva la conversazione anche quando la richiesta richiede operazioni più impegnative, come la ricerca di informazioni, un ragionamento articolato o l’esecuzione di attività avanzate.
In questi casi, il sistema può affidare il compito a un modello più potente, inizialmente GPT-5.5, senza creare lunghe interruzioni nel dialogo. L’obiettivo è consentire all’assistente vocale di continuare a interagire con l’utente mentre l’elaborazione più complessa viene gestita in parallelo.
OpenAI ha inoltre rinnovato l’intera modalità Conversazione di ChatGPT. Tra i miglioramenti annunciati figurano un riconoscimento vocale più affidabile anche in presenza di rumori improvvisi, una maggiore naturalezza delle risposte e la possibilità di scegliere il livello di approfondimento del ragionamento.
L’interfaccia può anche mostrare schede visive dedicate a informazioni utili, come previsioni meteo, risultati ed eventi sportivi, dati finanziari e altre informazioni contestuali. In questo modo, la voce non rimane un’esperienza esclusivamente sonora, ma si integra con contenuti visivi pensati per rendere le risposte più chiare e complete.

Leggi anche:
Nuove voci e maggiore attenzione alla sicurezza
Per accompagnare il debutto della nuova tecnologia, tutte e nove le voci proprietarie disponibili in ChatGPT sono state nuovamente registrate e adattate a GPT-Live. Il risultato punta a offrire una resa più espressiva, coerente e credibile durante le conversazioni prolungate.
Una parte importante dello sviluppo ha riguardato anche la sicurezza. Il modello è stato sottoposto a test specifici per le interazioni vocali, comprese situazioni caratterizzate da un forte coinvolgimento emotivo. Il sistema integra meccanismi progettati per correggere risposte potenzialmente rischiose e, nei casi in cui sia necessario, interrompere l’interazione.
Per gli utenti adolescenti sono inoltre previste limitazioni legate all’età e funzionalità di controllo parentale, con l’obiettivo di offrire un’esperienza più adatta alle diverse fasce di pubblico.
Disponibilità su iOS, Android e web
La distribuzione di GPT-Live è già iniziata per gli utenti ChatGPT a livello globale. La nuova modalità sarà disponibile su iOS, Android e nella versione web del servizio, con modelli differenti in base al piano utilizzato.
GPT-Live-1 è destinato a diventare il modello vocale principale per gli abbonati ai piani Go, Plus e Pro. Gli utenti del piano gratuito, invece, avranno accesso a GPT-Live-1 mini, una variante più leggera pensata per offrire le principali funzionalità della nuova esperienza vocale con requisiti ridotti.
Con questa evoluzione, OpenAI punta a superare il tradizionale schema domanda-risposta e a trasformare ChatGPT in un assistente capace di sostenere conversazioni vocali più spontanee, reattive e continue. La combinazione tra ascolto simultaneo, risposte in tempo reale e supporto di modelli avanzati potrebbe rappresentare uno dei cambiamenti più significativi introdotti finora nell’interazione vocale con l’intelligenza artificiale.
Ti potrebbe interessare:
Segui guruhitech su:
- Google News: bit.ly/gurugooglenews
- Telegram: t.me/guruhitech
- Facebook: facebook.com/guruhitechfb
- Instagram: instagram.com/guruhitech_official/
- X (Twitter): x.com/guruhitech1
- Bluesky: bsky.app/profile/guruhitech.bsky.social
- Rumble: rumble.com/user/guruhitech
- VKontakte: vk.com/guruhitech
- MeWe: mewe.com/i/guruhitech
- Skype: live:.cid.d4cf3836b772da8a
- WhatsApp: bit.ly/whatsappguruhitech
Esprimi il tuo parere!
Che ne pensi di questa notizia? Lascia un commento nell’apposita sezione che trovi più in basso e se ti va, iscriviti alla newsletter.
Per qualsiasi domanda, informazione o assistenza nel mondo della tecnologia, puoi inviare una email all’indirizzo [email protected].
Scopri di più da GuruHiTech
Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.
