Slimmer, goedkoper en gebouwd voor AI-agenten
Amper drie weken na Gemini 3.6 Flash trekt Google alweer het doek van een nieuw AI-model. Gemini 3.7 Flash moet vooral uitblinken als het werkpaard achter softwareontwikkeling en AI-agenten. De nieuwe versie redeneert beter, schrijft nauwkeuriger code, kan complexere bedrijfsprocessen uitvoeren en wordt tijdelijk aangeboden tegen de helft van de oorspronkelijke prijs van zijn voorganger.
Introducing Gemini 3.7 FlashGemini 3.7 Flash is our most intelligent workhorse model yet for coding and agents. |
Een AI-model dat vooral moet werken
Met Gemini 3.7 Flash kiest Google nadrukkelijk voor praktische inzetbaarheid. Het model is niet alleen bedoeld om vragen te beantwoorden, maar vooral om zelfstandig langere en complexere workflows uit te voeren.
Volgens Google profiteert de nieuwe versie van zowel algoritmische verbeteringen als feedback van ontwikkelaars. Vooral bij software-engineering, kenniswerk en webontwikkeling zou de vooruitgang duidelijk zichtbaar zijn. Het model moet bovendien beter omgaan met obstakels tijdens een taak, nauwkeuriger instructies volgen en indien nodig eerst verduidelijking vragen voordat het verdergaat.
Dat is belangrijk voor AI-agenten. Wanneer een model meerdere stappen achter elkaar moet plannen, softwaretools moet gebruiken en tussentijds beslissingen moet nemen, kan een kleine fout immers snel doorwerken in de rest van het proces.
Grote sprong bij programmeren
Een van de opvallendste verbeteringen zit bij softwareontwikkeling. Gemini 3.7 Flash presteert volgens Google aanzienlijk beter bij onder meer debugging, het oplossen van softwareproblemen en het produceren van code die meteen bruikbaar is.
Op FrontierCode 1.1 Main stijgt de score bijvoorbeeld van 34,4 procent bij Gemini 3.6 Flash naar 43,6 procent bij 3.7 Flash. Op DeepSWE v1.1 loopt het verschil nog verder op: van 49,0 naar 65,3 procent.
Ook webontwikkeling krijgt extra aandacht. Gemini 3.7 Flash kan volgens Google met minder prompts completere websites en applicaties produceren. Wanneer een screenshot, afbeelding of designsysteem als voorbeeld wordt meegegeven, zou het model de oorspronkelijke vormgeving bovendien nauwkeuriger kunnen volgen.
Op WebDev Arena haalt het nieuwe model een Elo-score van 1588, tegenover 1538 voor Gemini 3.6 Flash.
Van juridische documenten tot bedrijfsprocessen
De verbeteringen beperken zich niet tot programmeurs. Google positioneert Gemini 3.7 Flash eveneens voor kennisintensieve sectoren zoals financiën, juridische dienstverlening en biowetenschappen.
Dat wordt onder meer zichtbaar bij het analyseren van ingewikkelde documenten. Op GDP.pdf, een benchmark voor het begrijpen en verwerken van complexe documenten, stijgt de score van 22,0 naar 34,0 procent.
Nog groter is het verschil op AutomationBench, dat kijkt naar het uitvoeren van realistische bedrijfsprocessen. Daar klimt Gemini 3.7 Flash van 17,0 naar 30,4 procent.
Daarmee verschuift de aandacht steeds verder van de klassieke chatbot naar AI die daadwerkelijk werkzaamheden kan uitvoeren. Een model kan bijvoorbeeld informatie uit bestanden verzamelen, gegevens verwerken, documenten bijwerken en verschillende softwaretools binnen één workflow combineren.
AI-agenten krijgen meer discipline
Juist bij zulke langere opdrachten wil Google het verschil maken. Gemini 3.7 Flash zou zorgvuldiger nadenken over meerstapsplanning en het gebruik van tools. Het model moet minder snel vastlopen en beter reageren wanneer een oorspronkelijke aanpak niet werkt.
Voor bedrijven kan dat belangrijker zijn dan een hogere score op een losse benchmark. Een AI-agent die minder menselijke controle en minder nieuwe pogingen nodig heeft, kan immers goedkoper en betrouwbaarder op grote schaal worden ingezet.
Google demonstreert die mogelijkheden met uiteenlopende toepassingen: van een volledig speelbare 3D-game die vanuit tekst wordt opgebouwd tot interactieve websites, robottraining en het omzetten van statische jaarverslagen in interactieve dataverhalen.
Lagere prijs moet grootschalige inzet stimuleren
Naast betere prestaties zet Google stevig in op prijs. Tot eind 2026 kost Gemini 3.7 Flash 0,75 dollar per miljoen inputtokens en 3,75 dollar per miljoen outputtokens. Dat introductietarief bedraagt de helft van de oorspronkelijke prijs van Gemini 3.6 Flash.
Vanaf 1 januari 2027 stijgt dat naar respectievelijk 1,50 en 7,50 dollar per miljoen tokens.
Die prijsstrategie is veelzeggend. In de volgende fase van generatieve AI draait de concurrentie niet alleen om welk model het slimst is. Voor organisaties die miljoenen of miljarden tokens verwerken, wordt de verhouding tussen intelligentie, snelheid en kosten minstens zo belangrijk.
Gemini 3.7 Flash wordt daarmee nadrukkelijk neergezet als een model waarmee ontwikkelaars productieklare agenten op grotere schaal kunnen bouwen.
Ook Gemini Spark krijgt een upgrade
De technologie verhuist tegelijkertijd naar Gemini Spark, Googles persoonlijke AI-agent die voortdurend beschikbaar kan blijven en namens de gebruiker taken uitvoert. Spark is beschikbaar voor Google AI Pro- en Ultra-abonnees in meer dan 160 landen.
Dankzij Gemini 3.7 Flash moet de agent beter worden in kenniswerk en in het gebruiken van Google Workspace-toepassingen. Zo kan Spark bestanden samenbrengen, e-mails opstellen en statusdocumenten aanpassen.
Daarmee wordt duidelijk waar Google naartoe wil: Gemini moet steeds minder een afzonderlijke bestemming zijn waar iemand een vraag stelt, en steeds meer een intelligente laag worden die zelfstandig tussen applicaties, documenten en gegevens beweegt.
Veiligheid groeit mee met de mogelijkheden
Meer autonomie brengt tegelijk nieuwe risico's mee. Google zegt daarom de beveiligingsmaatregelen van Gemini 3.7 Flash verder te hebben aangescherpt. Het model krijgt bijgewerkte waarborgen tegen misbruik op het gebied van chemische, biologische, radiologische en nucleaire toepassingen en offensieve cyberactiviteiten.
Dat veiligheidsvraagstuk wordt belangrijker naarmate AI-modellen beter worden in het gebruiken van tools en het zelfstandig uitvoeren van langdurige processen. Dezelfde eigenschappen die een digitale assistent productiever maken, kunnen bij verkeerd gebruik immers ook krachtigere ongewenste toepassingen mogelijk maken.
De strijd verschuift van chatbot naar digitale werkkracht
Gemini 3.7 Flash illustreert vooral hoe snel de ontwikkeling van AI-modellen inmiddels verloopt. Slechts drie weken na zijn voorganger verschijnt alweer een model dat op verschillende praktische taken forse verbeteringen laat zien.
Maar misschien is de belangrijkste verandering minder zichtbaar in de benchmarks. Google bouwt steeds duidelijker voor een wereld waarin AI niet alleen informatie genereert, maar ook handelt: code aanpassen, documenten analyseren, software bedienen, workflows uitvoeren en andere gespecialiseerde agenten aansturen.
Gemini 3.7 Flash moet daarbij het nieuwe werkpaard worden. Niet noodzakelijk het grootste of meest spectaculaire model, maar wel een model dat intelligentie, snelheid en kosten zo combineert dat AI-agenten op grote schaal praktisch inzetbaar worden.









