OpenAI's GPT-Live Spraakmodus Krijgt Bestandsbijlagen, Projecten en Kruisfunctie-integratie
Belangrijkste punten
- •GPT-Live gebruikt een full-duplex spraakarchitectuur die gelijktijdig luisteren en spreken mogelijk maakt, ter ondersteuning van natuurlijk gespreksgedrag zoals onderbrekingen midden in een zin en overlappende dialogen.
- •Het vlaggenschipmodel GPT-Live-1 is beschikbaar voor betalende abonnees met volledige mogelijkheden, terwijl gebruikers in het gratis pakket GPT-Live-1 mini ontvangen met beperkte verwerkingscapaciteit.
- •GPT-Live kan rekenintensieve taken routeren naar krachtigere modellen zoals GPT-5.5, terwijl een responsieve realtime spraaklaag behouden blijft.
- •Spraaksessies ondersteunen nu bestandsbijlagen, beeldverwerking, geheugenfuncties, websearch en integratie met de Projects-functie voor Work-, Codex- en desktopomgevingen.
- •De ChatGPT Library ondersteunt momenteel geen directe bestandszoekactie of bestandstoewijzing tijdens spraaksessies, wat een resterende beperking vormt in het bijgewerkte systeem.

OpenAI lanceerde GPT-Live op 8 juli 2026 en vestigde het als de nieuwe standaard spraakmodelfamilie voor ChatGPT. De update brengt bestandsbijlagen, projectintegratie, geheugen en zoekmogelijkheden naar een deel van het product dat voorheen grotendeels geïsoleerd functioneerde.
Gebruikers kunnen nu een spraakgesprek voeren met ChatGPT en tegelijkertijd documenten delen, waardoor het niet meer nodig is om over te schakelen naar de tekstmodus voor op content gebaseerde taken. Deze verandering pakt een al lang bestaand knelpunt in AI-assistenten aan, waar spraakinteracties doorgaans werden behandeld als een apart oppervlak in plaats van een geïntegreerde laag die toegang heeft tot dezelfde hulpmiddelen en context als in op tekst gebaseerde workflows.
Full-Duplex Spraakarchitectuur
GPT-Live is een familie van full-duplex spraakmodellen, wat betekent dat het systeem tegelijkertijd kan luisteren en spreken in plaats van beurtelings te wisselen. Dit maakt natuurlijke gespreksgedragingen mogelijk zoals onderbrekingen midden in een zin en overlappende dialogen, wat traditionele op beurten gebaseerde spraakassistenten niet konden verwerken zonder antwoorden af te breken of te herstarten. Het vlaggenschipmodel is GPT-Live-1, beschikbaar voor betalende abonnees met de volledige functionaliteitsset. Een lichtere variant, GPT-Live-1 mini, wordt aangeboden aan gebruikers in het gratis pakket en deelt dezelfde conversationele architectuur, maar met beperkte capaciteitsruimte.
GPT-Live kan rekenintensieve taken delegeren aan krachtigere modellen, waaronder GPT-5.5, terwijl een responsieve spraaklaag wordt behouden. Deze routeringsarchitectuur weerspiegelt een bredere brancheontwikkeling waarbij lichtgewicht, low-latency interfaces het werk orchestreren dat wordt uitgevoerd door zwaardere backend-modellen — een ontwerpkeuze die een balans vindt tussen realtime responsiviteit en diepgaande redeneercapaciteit.
Bestandsbijlagen en Projects-integratie
De operationeel meest significante toevoeging is ondersteuning voor bestandsbijlagen tijdens live spraaksessies. Gebruikers kunnen bestanden toevoegen midden in een gesprek en ChatGPT die content in real time laten verwerken. De update introduceert ook beeldverwerking, geheugenfuncties en websearch binnen spraaksessies.
GPT-Live koppelt nu aan de Projects-functie van ChatGPT, waarmee gebruikers persistente context over sessies kunnen behouden via opgeslagen bestanden, voorkeuren en aangepaste instructies. Deze integratie strekt zich uit over Work-, Codex- en desktopomgevingen. Voor gebruikers die ChatGPT op meerdere oppervlakken gebruiken — conversationeel, programmeren en documentgericht — verandert de Projects-integratie spraak effectief van een zelfstandige interactiemodus naar een gedeeld toegangspunt dat uit dezelfde kennisbasis kan putten als andere interfaces.
Eén beperking blijft bestaan: de ChatGPT Library, die documenten apart van Projects opslaat, ondersteunt momenteel geen directe bestandszoekactie of bestandstoewijzing tijdens een spraaksessie.
Evolutie vanuit Advanced Voice Mode
GPT-Live vertegenwoordigt een incrementele volwassenwording van wat OpenAI eerder Advanced Voice Mode noemde, in plaats van een fundamentele heruitvinding. Advanced Voice Mode introduceerde natuurlijkere prosodie en emotionele reikwijdte in de spraak van ChatGPT, maar opereerde nog steeds op een op beurten gebaseerd systeem. GPT-Live voegt structurele connectiviteit toe en koppelt spraak aan het bredere productecosysteem, waaronder search, geheugen, bestandsuploads en Projects-integratie. Deze ontwikkeling weerspiegelt een bredere push onder conversationele AI-aanbieders om spraak, tekst en multimodale invoer te verenigen onder één sessiemodel, in plaats van parallelle capaciteiten met onsamenhangende functionaliteitssets te behouden.