Google DeepMind lanceert Gemini 3.8 Live en 3.8 Live Extended Thinking voor natuurlijke stem-AI
Belangrijkste punten
- •Google DeepMind lanceerde op 15 september 2026 Gemini 3.8 Live en Gemini 3.8 Live Extended Thinking, die het bedrijf beschrijft als zijn meest geavanceerde live dialoogmodellen tot nu toe.
- •Gemini 3.8 Live Extended Thinking eindigde overall eerste op Artificial Analysis' Speech to Speech Quality Index, met 68,6% op de τ-Voice agentische benchmark en 97,7% op Big Bench Audio.
- •De modellen verwerken visuele invoer in bijna realtime, wisselen automatisch tussen 97 ondersteunde talen tijdens het gesprek en voeren tools en API-aanroepen op de achtergrond uit terwijl het gesprek doorloopt.
- •Gemini 3.8 Live is gepositioneerd voor schaal en kostenefficiëntie, terwijl Extended Thinking is ontworpen voor hoogcomplexe taken met gelijktijdig redeneren en spreken, waaronder live voortgangscommentaar.
- •Beide modellen zijn vanaf vandaag beschikbaar via de Gemini API en Google AI Studio, met uitrol voor ondernemingen en consumenten via Gemini Enterprise, Google Workspace, Search Live en de Gemini-app.

Google DeepMind kondigde op 15 september 2026 de lancering aan van Gemini 3.8 Live en Gemini 3.8 Live Extended Thinking, die het bedrijf beschrijft als zijn meest geavanceerde live dialoogmodellen tot nu toe. Volgens de aankondiging brengen de twee modellen vooruitgang in bijna realtime redeneren om spraakagents effectiever mogelijk te maken, met belangrijke verbeteringen in intelligentie en parallel redeneren die ze intuïtiever maken om mee samen te werken en beter geschikt om complexe taken met de stem uit te voeren.
Het bericht is geschreven door Tom Ouyang, Principal Engineer, en Malini Jaganathan, Member of Technical Staff, namens het Gemini Audio Team.
Google zei dat de lancering bedoeld is om spraakinteracties natuurlijker, vlotter en intelligenter te maken. De nieuwe modellen verwerken complex redeneren, realtime visuele context en taakuitvoering op de achtergrond zonder een lopend gesprek te onderbreken. Ze kunnen onderbrekingen aan, wisselen tussen talen en leggen hun denkproces uit terwijl ze werken — gedrag dat Google omschrijft als een stap richting AI die aanvoelt als een echte gesprekspartner. Of gebruikers nu een complex probleem oplossen of gewoon een praatje maken, de ervaring is volgens het bedrijf ontworpen om te voelen alsof de AI meeluistert en meedenkt. De functies zijn vanaf vandaag beschikbaar via de Gemini API, Google Workspace en de Gemini-app.
De twee modellen richten zich op verschillende toepassingen:
- Gemini 3.8 Live is gebouwd voor schaal en kostenefficiëntie en combineert gespreksintelligentie met vlotte dialoog en visuele verankering.
- Gemini 3.8 Live Extended Thinking is gebouwd voor hoogcomplexe taken, met verhoogde intelligentie en meerstaps-redeneren.
Voor ontwikkelaars en ondernemingen positioneert Google de modellen als bouwstenen voor betrouwbare, productieklare spraakagents. Het bedrijf zegt ook dat ze praten met Gemini in de Gemini-app, Google Workspace en Search vlotter en collaboratiever maken, zodat gebruikers complexe taken uitsluitend met hun stem kunnen uitvoeren.
Benchmarks en prestaties
Gemini 3.8 Live Extended Thinking levert wat Google omschrijft als taakuitvoering en intelligentie op ondernemingsniveau, en veroverde de #1-positie overall op de Speech to Speech Quality Index van Artificial Analysis met een score van .6. Het model leidt bij agentische taakuitvoering, met 68,6% op τ-Voice en 35,1% op Sierra's τ-Voice-banking-benchmark. Het biedt ook sterke redeneervermogen, met een score van 97,7% op Big Bench Audio, terwijl het een zeer concurrerende prijs houdt vergeleken met andere frontiermodellen.
Gemini 3.8 Live kreeg een hoge voorkeur onder gebruikers en behaalde een tweede plaats in de Speech Agent Arena. Naast dit resultaat blijft het volgens Google zeer kostenefficiënt, en biedt het ontwikkelaars en ondernemingen een krachtig en efficiënt model dat gebouwd is voor schaal.
Op ServiceNow's EVA-Bench, een benchmark voor het evalueren van spraakagents, zei Google dat zijn modellen de Pareto-grens voor complexe workflows verschuiven door nauwkeurigheid succesvol in balans te brengen met gesprekskwaliteit. Het bedrijf merkt op dat de evaluatie werd uitgevoerd op de Live API op het Gemini Enterprise Agent Platform.
Visuele context, 97 talen en uitvoering op de achtergrond
Gemini 3.8 Live verwerkt visuele invoer in bijna realtime en verrijkt gesprekken met context voor nuttigere antwoorden. Het detecteert en wisselt automatisch tussen de 97 ondersteunde talen tijdens het gesprek. Het model voert ook tools en API-aanroepen op de achtergrond uit terwijl het gesprek doorloopt, zodat het verzoeken kan bevestigen en door kan blijven praten terwijl taken achter de schermen worden afgerond.
Videodemonstraties bij de aankondiging tonen het model dat werknemersinstructies in realtime begeleidt, visuele context gebruikt om live vragen te beantwoorden, en bijna realtime schaak speelt door visuele context, redeneren en natuurlijke gespreksstroom te combineren.
Tegelijk redeneren en spreken
Voor taken die dieper redeneren vereisen, redeneert Gemini 3.8 Live Extended Thinking en spreekt het tegelijkertijd. Google zegt dat het model verhoogde intelligentie levert voor complexe workflows met een ononderbrokenpreksstroom. Het gebruikt vroege verbale signalen, zoals "Laat me dat even controleren…", om verzoeken op natuurlijke wijze te bevestigen, en biedt live voortgangscommentaar om gebruikers door meerstaps-taken op de achtergrond te leiden naarmate die vorderen.
Demonstraties omvatten Gemini 3.8 Live Extended Thinking dat ruwe schetsen en bijna realtime spraakfeedback omzet in functionele React-componenten, en het coördineren van meerstaps-boekingen en asynchrone functie-aanroepen zonder het natuurlijke live gesprek te onderbreken. Google liet ook zien hoe Gemini 3.8 Live complete bedrijfsplannen en aangepaste marketingtoolkits ter plekke opbouwt via natuurlijke spraak.
Integratie in Google Workspace en Search
In Google Workspace en Search zijn de Live-modellen ontworpen om intuïtievere, collaboratievere ervaringen te bieden, vooral bij de meest complexe taken. Gemini 3.8 Live Extended Thinking kan in Google Workspace worden gebruikt via Docs Live, Gmail Live en Keep Live. Search Live biedt stapsgewijze hulp bij probleemoplossing in realtime, aangedreven door Gemini 3.8 Live.
Stem-ecosysteem voor ontwikkelaars en ondernemingen
Met behulp van de Gemini Live API maken ontwikkelaarsplatforms zoals Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel en Vision Agents het ontwikkelaars mogelijk om eenvoudig krachtige, stemgestuurde interfaces te bouwen en uit te rollen. Deze platforms beheren complexe realtime media-streaminginfrastructuur op de achtergrond, waardoor ontwikkelaars zich volledig kunnen richten op het vormgeven van de gebruikerservaring.
Google voegde toe dat het samenwerkt met bedrijven zoals Salesforce, Genspark en Lumeris die enthousiast zijn over 3.8 Live en 3.8 Live Extended Thinking, waarbij ze de indrukwekkende latentie, vlotheid en tool-calling-mogelijkheden van de modellen benadrukken.
Transparantie met SynthID-watermerken
Alle audio die door Google's AI-producten wordt gegenereerd, is voorzien van een SynthID-watermerk. Het bedrijf zegt dat dit onwaarneembare watermerk direct in de audio-uitvoer is verweven, zodat door AI gegenereerde content detecteerbaar blijft om desinformatie te helpen voorkomen. Voor details over de aanpak van het bedrijf op het gebied van veiligheid en verantwoordelijkheid verwijst Google lezers naar de model card.
Beschikbaarheid
Beide modellen worden vanaf vandaag uitgerold, voor ontwikkelaars, ondernemingen en consumenten.
Gemini 3.8 Live:
- Voor ontwikkelaars: in de Gemini API en Google AI Studio.
- Voor ondernemingen: in private preview in Gemini Enterprise, en binnenkort in Gemini Enterprise for Customer Experience.
- Voor iedereen: in Search Live.
Gemini 3.8 Live Extended Thinking:
- Voor ontwikkelaars: in de Gemini API en Google AI Studio.
- Voor ondernemingen: in private preview in Gemini Enterprise, en binnenkort in Gemini Enterprise for Customer Experience en voor Google Workspace-zakelijke klanten.
- Voor iedereen: in Gemini Live, voor Google AI Pro- en Ultra-abonnees in Workspace in Docs, en voor alle Google AI-abonnees in Gmail en Keep.
De volledige aankondiging, inclusief videodemonstraties, is beschikbaar op de Google DeepMind-blog.