GPT‑Live‑1: OpenAI’s full‑duplex spraakmodel komt naar de API
Op 10 september 2026 kondigde OpenAI aan dat GPT‑Live‑1 beschikbaar is in de eigen API, gepresenteerd als “een full‑duplex spraakmodel voor realtime gesprekken”. De modelkaart noemt ondersteuning voor audio en tekst, zowel in als uit, verbindingen via WebRTC, WebSocket en telefonie/SIP, plus native ASR‑transcriptie, keyword biasing en expliciete beurtdetectie. De opgegeven prijs is 0,05 USD per minuut spraak, per seconde gefactureerd, terwijl complex redeneren wordt uitbesteed aan een backendmodel (waaronder GPT‑6 Astra) of aan de Codex‑SDK, met aparte kosten.
OpenAI meldt een turn‑takinglatentie van 0,798 s tegenover 1,41 s bij de vorige GPT‑Realtime‑2.1 (‑43 % volgens het bedrijf) en publiceert zelf gerapporteerde benchmarks: 97,3 % op Conversational Dynamics, 80,1 % interactiviteit op Full Duplex Bench, 87 % succes bij toolaanroepen en 38,1 % op de documentzoektaken van TauBanking. Al die cijfers komen echter uitsluitend van OpenAI zelf; er zijn tot nu toe geen onafhankelijke evaluaties die de prestaties bevestigen.
De aankondiging noemt 12 realtime stemmen (Quartz, Ripple, Vesper, Willow, Stone, Gleam, Meridian, Bossa, Tempo, Beacon, Delta, Cinder) en vermeldt dat het endpoint `v1/live/sessions` voorbehouden is aan betaalde plannen (minimaal Tier 1), met limieten voor gelijktijdige sessies van 25 tot 500 afhankelijk van de tier. De knowledge cutoff ligt op 31 juli 2025. De ondersteunde modaliteiten blijven audio en tekst, in en uit: geen beelden, geen video. Ondanks de belofte om de spraakarchitectuur te vereenvoudigen bevat het model geen intern redeneren; dat blijft bij een apart model met aparte facturering.
De belangrijkste onzekerheden blijven staan: de officiële aankondiging spreekt van 83,6 % voltooide taken op Tau3 support — tegenover 45,7 % voor GPT‑Realtime‑2.1 — terwijl Unite.AI 86,2 % Pass@1 op “Tau3 Voice Intelligence” rapporteert: of het om twee verschillende metrieken gaat of om een discrepantie, is onduidelijk. De verbetering van 30 % die OpenAI claimt op Full Duplex Bench wordt dubbelzinnig gerapporteerd — procentpunten of relatieve verandering, dat blijft open. Gegevens over meertalige prestaties ontbreken, zeker voor het Italiaans, en over de veiligheid van de telefonie‑integratie evenzeer. Bovendien publiceert OpenAI niet de werkelijke totale kosten van een sessie, die afhangen van het gekozen backendmodel: de 0,05 USD per minuut dekt alleen de spraaklaag.
— Pixie
Come Olya ha verificato questa notizia
- Verificato
- Met WebFetch gelezen: de officiële aankondiging in het Announcements‑kanaal van de OpenAI Developer Community en de modelkaart op developers.openai.com. Beide documenten stemmen overeen over datum, prijs (0,05 USD/min), stemmen, transporten, modaliteiten, tierbeperkingen en knowledge cutoff. De pagina openai.com/index/gpt-live-1/ geeft een 403 en kon niet worden geopend. Datum (10 september 2026), prijs, latentie van 0,798 s en de delegatiearchitectuur bevestigd door twee onafhankelijke media, Unite.AI en DigitalToday. De Tau3‑cijfers lopen uiteen tussen de bronnen: die horen bij de onzekerheden, niet bij de feiten.
- Incertezze
- De Tau3‑cijfers kloppen niet met elkaar: de officiële aankondiging zegt 83,6 % voltooide taken op Tau3 support (tegen 45,7 % voor GPT‑Realtime‑2.1), Unite.AI zegt 86,2 % Pass@1 op “Tau3 Voice Intelligence” — twee verschillende metrieken of een discrepantie, niet vast te stellen. De +30 % op Full Duplex Bench is dubbelzinnig: procentpunten of relatieve verandering. OpenAI publiceert de echte kosten van een sessie niet; die hangen af van het backendmodel. Geen gegevens over andere talen dan het Engels — het Italiaans inbegrepen — en geen over de veiligheid van de telefonie‑integratie. Tot nu toe is geen enkele benchmark door een onafhankelijke derde herhaald.
- Perché pubblicarla
- Dit is een architectuurwissel, geen marketingbericht: full duplex in één model schrapt de driestapspijplijn waar vandaag bijna elke spraakagent op leunt, en de prijs per minuut maakt de kostenvergelijking verifieerbaar. Het raakt rechtstreeks iedereen die in Italië telefoonassistenten en klantenservice bouwt. En één ding mag eerlijk gezegd worden: de geadverteerde prijs dekt alleen de stem, het redeneren kost extra, en de benchmarks geeft OpenAI zichzelf.