Op 15 september lanceerde Google Gemini 3.8 Live en Gemini 3.8 Live Extended Thinking. Dit zijn geen gewone spraakmodellen. Dit zijn spraakmodellen die taken kunnen uitvoeren terwijl je praat bron.
Het concept: je vraagt iets via spraak. Het model zegt “even kijken” of “ik ben ermee bezig”, en blijft ondertussen werken. Je hoeft niet te wachten tot het klaar is. Je kunt iets anders vragen, een nieuw onderwerp aansnijden, en het model houdt beide taken bij bron.
Gemini 3.8 Live Extended Thinking is het model voor complexe taken. Het kan redeneren én praten tegelijk. De benchmarkresultaten zijn indrukwekkend: 82.6 op de Speech-to-Speech Quality Index (nummer 1), 68.6% op τ-Voice (agentische taakvoltooiing, nummer 1), en 97.7% op Big Bench Audio bron.
Wat dit praktisch betekent: je kunt tegen je telefoon zeggen “zoek een restaurant voor vanavond, boek een tafel voor vier, en stuur een bericht naar de groep”. En terwijl je dat zegt, begint het model al te zoeken. Je hoeft niet te wachten op een antwoord om de volgende vraag te stellen.
Beide modellen zijn beschikbaar via de Gemini API, Google AI Studio, Search Live en Gemini Live. Voor ontwikkelaars is dit de eerste keer dat je een spraakmodel kunt bouwen dat agentische taken uitvoert zonder de conversatie te onderbreken bron.
Alle gegenereerde audio krijgt een SynthID-watermerk. Onhoorbaar, maar detecteerbaar. Google probeert hiermee deepfake-audio tegen te gaan bron.
















Laat een reactie achter