Il 10 settembre 2026, OpenAI ha reso il suo modello vocale full-duplex GPT-Live-1 disponibile nell’API. Lo stesso modello che alimenta la modalità vocale di ChatGPT è ora aperto a qualsiasi sviluppatore che costruisce agenti vocali personalizzati.
Ascoltare e parlare subito
A differenza delle tradizionali API vocali a turni, GPT-Live-1 continua a elaborare audio in arrivo mentre sta parlando. I chiamanti possono interrompere l’interferenza senza rompere la conversazione. Secondo OpenAI, il modello navi trascrizioni native, rilevamento di turno, migliore gestione del rumore di fondo e supporto telefonico per le distribuzioni basate sul telefono. Dodici voci sono disponibili al lancio.
Prezzi e sconti
I prezzi OpenAI hanno accesso a $0.05 al minuto, ma questo copre solo lo strato vocale. Qualunque sia il modello di backend fa il ragionamento viene fatturato in cima. Un avvertimento: il precedente GPT-Realtime-2.1 ha accettato l’ingresso dell’immagine, una capacità GPT-Live-1 scende secondo i rapporti disponibili finora.
Benchmark è una domanda di venditore
OpenAI dice che GPT-Live-1 migliora le prestazioni sul suo “Full Duplex Bench” interno di 30 punti percentuali su GPT-Realtime-2.1. Questa è una cifra del fornitore; i numeri indipendenti non erano disponibili al lancio. Se il modello vive fino alla demo in produzione sarà chiaro solo una volta che i test di terze parti terra.
Fonti: annuncio e report di OpenAI Dati Nord (dal 10 settembre 2026).



















