Taalbarrières tijdens livestreams, online evenementen en internationale vergaderingen zouden weleens een stuk kleiner kunnen worden. In een nieuwe demonstratie laat Google zien hoe ontwikkelaars met Gemini 3.5 Live Translate, LiveKiten Google Cloud Run een toepassing kunnen bouwen die gesproken taal vrijwel realtime vertaalt en opnieuw uitzendt.
Het voorbeeld draait daarbij niet alleen om de mogelijkheden van generatieve AI. Het toont vooral hoe live vertaling kan worden geïntegreerd in een volwaardige technische infrastructuur voor meertalige communicatie.
Van één spreker naar meerdere talen
Het uitgangspunt is eenvoudig: iemand spreekt tijdens een live-uitzending, terwijl luisteraars de inhoud in een andere taal kunnen volgen. Achter die ogenschijnlijk simpele ervaring bevindt zich echter een keten van systemen die voortdurend audio moeten ontvangen, verwerken, vertalen en doorsturen.
Gemini 3.5 Live Translate neemt daarin de intelligente vertaallaag voor zijn rekening. LiveKit verzorgt de realtime communicatie-infrastructuur, terwijl Google Cloud Run wordt gebruikt om de toepassing in de cloud te draaien en uit te rollen.
Zo ontstaat een architectuur die veel verder gaat dan het klassieke model waarbij eerst een opname wordt gemaakt, vervolgens een transcript wordt geproduceerd en pas daarna een vertaling verschijnt. De bedoeling is juist dat al die stappen onderdeel worden van een doorlopende live-ervaring.
WebSockets houden de vertaling in beweging
Een belangrijk technisch onderdeel van de demonstratie is het gebruik van WebSocket-verbindingen. Die maken permanente communicatie tussen de toepassing en achterliggende diensten mogelijk.
Dat is essentieel voor live audio. In plaats van telkens afzonderlijke verzoeken naar een server te sturen en op een volledig antwoord te wachten, kan informatie voortdurend heen en weer bewegen. Terwijl iemand spreekt, kunnen audiogegevens worden verwerkt en kan de vertaalsessie actief blijven.
De demonstratie besteedt daarom aandacht aan het opzetten en beheren van vertaalsessies en de verbindingen die daarvoor nodig zijn. Voor ontwikkelaars is dat minstens zo belangrijk als het AI-model zelf: een indrukwekkende vertaling heeft weinig waarde wanneer de technische infrastructuur voor haperingen of grote vertragingen zorgt.
LiveKit vormt de realtime ruggengraat
LiveKit speelt in het project de rol van realtime communicatieplatform. Dergelijke technologie kan audio- en videostreams tussen deelnemers beheren en vormt daardoor een logische basis voor toepassingen waarin meerdere mensen tegelijkertijd spreken of luisteren.
Door die infrastructuur te combineren met Gemini ontstaat een interessant patroon. AI wordt niet langer uitsluitend gebruikt nadat een gesprek is afgelopen, maar wordt midden in de communicatiestroom geplaatst.
Dat opent mogelijkheden voor bijvoorbeeld internationale webinars, conferenties, bedrijfsvergaderingen, opleidingen en livestreams. Een spreker zou in één taal kunnen presenteren, terwijl verschillende groepen luisteraars ieder een eigen vertaalde audiostream ontvangen.
Cloud Run brengt het prototype naar de cloud
De demonstratie stopt niet bij een lokaal experiment. Ook de implementatie via Google Cloud Run komt aan bod.
Daarmee verschuift het project van een AI-demo naar iets dat meer op een echte cloudtoepassing begint te lijken. De vertaaldienst kan als onderdeel van een webarchitectuur worden uitgerold zonder dat ontwikkelaars zelf alle onderliggende serverinfrastructuur hoeven te beheren.
Voor organisaties is dat relevant. Een live vertaalsysteem moet immers niet alleen technisch werken, maar ook kunnen omgaan met wisselende aantallen gebruikers en uitzendingen.
Open source maakt experimenteren eenvoudiger
Google stelt ook de code van de demonstratie beschikbaar. Daardoor kunnen ontwikkelaars bekijken hoe de verschillende onderdelen met elkaar communiceren en het voorbeeld als vertrekpunt gebruiken voor eigen toepassingen.
Tijdens de demonstratie wordt bovendien Antigravity ingezet om door de codebase te navigeren en de structuur van het project te onderzoeken. Daarmee krijgt het voorbeeld nog een tweede AI-laag: Gemini helpt bij de live vertaling, terwijl AI-ondersteunde ontwikkeltools kunnen helpen om de software achter die ervaring sneller te begrijpen en verder uit te bouwen.
Van ondertiteling naar directe meertalige communicatie
De interessantste ontwikkeling zit uiteindelijk niet alleen in de kwaliteit van automatische vertaling, maar in de snelheid waarmee vertaaltechnologie onderdeel wordt van realtime communicatie.
Waar automatische vertaling jarenlang vooral draaide om tekst, documenten en vooraf opgenomen materiaal, schuift de technologie steeds nadrukkelijker richting levende gesprekken. Stem, context en vertaling komen daarbij samen in één continue stroom.
Een internationale online presentatie zou daardoor op termijn minder afhankelijk kunnen worden van één gemeenschappelijke voertaal. De technologie kan in theorie een vertaallaag tussen spreker en luisteraar plaatsen zonder dat de oorspronkelijke presentatie hoeft te worden onderbroken.
Daarmee verandert live vertaling langzaam van een afzonderlijke functie in een infrastructurele bouwsteen voor digitale communicatie. De combinatie van Gemini Live API, LiveKit en cloudinfrastructuur laat vooral zien hoe ontwikkelaars zo'n toekomst vandaag al kunnen beginnen bouwen.









