OpenAI brengt full-duplex spraakbesturing van GPT-Live naar Codex en de ChatGPT-desktopapp
Belangrijkste punten
- •OpenAI heeft zijn GPT-Live-model voor full-duplex spraak geïntegreerd in de ChatGPT-desktopapp en koppelt het voor het eerst aan Codex en ChatGPT Work.
- •Ontwikkelaars kunnen gesproken commando’s gebruiken om meerdere gelijktijdige codeertaken te starten, zoals bugonderzoeken, pull request-beoordelingen en het genereren van unit tests, zonder hun workflow te onderbreken.
- •De integratie koppelt de realtime spraaklaag los van de uitvoeringsengines, waardoor GPT-Live een vloeiend gesprek kan onderhouden terwijl achtergrondmodellen zware computationele workloads verwerken.
- •Toegang tot de spraakgestuurde desktopfuncties is beperkt tot betalende abonnees van Plus-, Pro-, Business-, Enterprise- en Education-abonnementen, en de onderliggende systemen blijven volledig gesloten en niet zelf te hosten.
- •De release roept praktische vragen op voor engineeringteams over het aanpassen van codebeoordelingsstandaarden, beveiligingsbeleid voor ondernemingen en audittrails nu spraakgestuurde agenten repositories kunnen wijzigen en buildpijplijnen kunnen activeren.

Twee weken na de introductie van zijn GPT-Live-audio-AI-model met full-duplexfunctionaliteit—waarmee gelijktijdig luisteren en spreken mogelijk is—integreert OpenAI de technologie rechtstreeks in workflows voor ontwikkelaars.
Het bedrijf maakte bekend dat GPT-Live nu de ChatGPT-desktopapplicatie op macOS en Windows aandrijft en integreert met agentische systemen, waaronder Codex en ChatGPT Work, afzonderlijke ervaringen die beschikbaar zijn binnen de ChatGPT-desktopapp.
OpenAI lanceerde GPT-Live aanvankelijk op July 8, 2026, en introduceerde daarmee een continu audiomodel dat tegelijkertijd kan luisteren en spreken. Het ontwerp maakt een einde aan starre beurtwisselingen en delegeert complexe redeneertaken aan achtergrondmodellen zoals GPT-5.5. De nieuwste release breidt die conversatielaag uit naar technische taken, waardoor software-engineers met natuurlijke spraakcommando’s multi-threaded codeertaken kunnen orkestreren, pull requests kunnen beoordelen en applicaties kunnen debuggen.
De update kan een nieuw tijdperk van handsfree softwareontwikkeling inluiden—en zelfs live, fysieke groepscodeersessies—voor de meer dan 10 miljoen wekelijkse actieve gebruikers van Codex en ChatGPT Work. Codex is de naam voor OpenAI's modellen en harnas gericht op coderen, al heeft het bedrijf het dit jaar uitgebreid tot een breder productiviteitsplatform. Een woordvoerder van OpenAI vertelde VentureBeat dat dit de eerste keer is dat spraakactivatie in deze agentische codeertools is geïntegreerd. De stap komt op een moment dat de markt voor AI-ondersteund coderen steeds drukker wordt, met GitHub Copilot, Anthropic's Claude en Google's Gemini die allemaal autonome ontwikkelcapaciteiten uitbreiden—maar geen van hen heeft tot nu toe full-duplex spraak geïntroduceerd als primaire besturingsinterface voor codeeragenten.
OpenAI plaatste een promotievideo met medewerkers Jason Liu, Codex developer experience engineer, en Guinness Chen, technisch medewerker bij Codex, die in dezelfde ruimte met dezelfde ChatGPT-desktopappsessie spraken. Beiden gaven verschillende instructies en voerden tegelijkertijd een gesprek met hetzelfde model.
Hoe de integratie werkt
In de kern koppelt de integratie de realtime spraaklaag los van de onderliggende uitvoeringsengines. GPT-Live onderhoudt een vloeiend gesprek—met natuurlijke verbale bevestigingen zoals "got it" zonder de gebruiker te onderbreken—terwijl zware computationele workloads worden doorgestuurd naar achtergrondmodellen voor redeneren.
Op macOS bevat de desktopapplicatie "Appshots" en functies voor schermcontext, waardoor ChatGPT Voice het venster op de voorgrond kan analyseren naast lokale bestanden, codebasestructuren en actieve plug-ins. Deze architectuur creëert een pair-programmingdynamiek waarin ontwikkelaars problemen in gespreksvorm doornemen terwijl agenten taken asynchroon uitvoeren.
In plaats van codeersessies te onderbreken om gedetailleerde instructies te typen of tussen vensters te schakelen, kunnen ontwikkelaars het systeem volledig handsfree aansturen. De full-duplex-engine beslist dynamisch wanneer hij spreekt, pauzeert of tools aanroept, en behoudt de gespreksstatus terwijl achtergrondagenten complexe codewijzigingen verwerken.
Spraakgestuurd coderen en complexe builds
De centrale mogelijkheid in deze update is multitaskuitvoering binnen Codex- en ChatGPT Work-omgevingen. Software-engineers kunnen meerdere gelijktijdige taakthreads starten vanuit één gesproken prompt. Een ontwikkelaar die bijvoorbeeld een feature wil uitbrengen, kan het systeem tegelijkertijd opdracht geven om een open authenticatiebug te onderzoeken, een lopende pull request voor een API-migratie te beoordelen en ontbrekende unit tests te genereren.
De desktopapplicatie coördineert deze acties over uiteenlopende contexten heen, waarbij problemen worden getraceerd via Slack-gesprekken, GitHub-repositories en lokale codebases. Ontwikkelaars kunnen ook mondeling ontwerpmodellen omzetten in werkende code, waarbij taken worden verdeeld over frontend-, backend- en testlagen.
Met ondersteuning voor projecten met meerdere mappen (build 26.715) en uitvoering op afstand via iOS kunnen engineers de voortgang van taken controleren, prompts van agenten beantwoorden en actieve taken bijsturen zonder van applicatie te wisselen of afzonderlijke processen regel voor regel te beheren.
Proprietair licentiemodel
OpenAI's desktoprelease met spraakfunctionaliteit werkt onder een proprietair, commercieel ondernemingsmodel. Toegang is beperkt tot betalende abonnees van de Plus-, Pro-, Business-, Enterprise- en Education-abonnementen.
Voor individuele ontwikkelaars en engineeringafdelingen binnen bedrijven betekent dit dat modelgewichten, spraakverwerkingspijplijnen en architecturen voor agentstatus volledig gesloten blijven. Organisaties kunnen de onderliggende systemen niet aanpassen of zelf hosten. Taken die via ChatGPT Voice worden gestart, verbruiken standaardgebruikslimieten rechtstreeks uit bestaande quota van Codex- en ChatGPT Work-abonnementen, waarbij spraakgestuurde acties hetzelfde worden behandeld als standaard agentische workloads. De gesloten aanpak staat in contrast met codeermodellen met open gewichten van concurrenten zoals Meta's Code Llama en DeepSeek's Coder, al hebben die alternatieven nog niet dezelfde geïntegreerde spraak-agentische mogelijkheden bereikt die OpenAI uitrolt.
Reacties uit de community
Ontwikkelaarsgemeenschappen merkten onmiddellijk de implicaties op van het toevoegen van continue full-duplex spraak aan autonome codeerworkflows. In reactie op de aankondiging van build 26.715—waarin spraakintegratie en ondersteuning voor projecten met meerdere mappen worden beschreven—merkte op X AI Insider-journalist @ChrisGPT op: "Today OpenAI will release voice and remote guidance for codex ! One step closer to personal AGI".
Vroege technische feedback wijst op brede belangstelling voor het handsfree orkestreren van complexe agentische taken, vooral wanneer ontwikkelaars niet achter hun werkstation zitten of buildpijplijnen op afstand beheren. De release roept ook praktische vragen op voor engineeringteams over hoe standaarden voor codebeoordeling, beveiligingsbeleid voor ondernemingen en audittrails zich mogelijk moeten aanpassen nu spraakgestuurde agenten repositories kunnen wijzigen en buildpijplijnen kunnen activeren zonder traditionele, via het toetsenbord gemedieerde controle.