Google lanceert Gemini 3.6 Flash, 3.5 Flash-Lite en 3.5 Flash Cyber: drie nieuwe AI-modellen die tokenkosten verlagen en prestaties verbeteren voor enterprise-agenten in Nederland.
Google heeft zojuist drie nieuwe AI-modellen gelanceerd die speciaal zijn ontworpen om de kosten en vertraging van enterprise AI-agenten te verminderen. Denk aan Gemini 3.6 Flash, 3.5 Flash-Lite en een speciale 3.5 Flash Cyber-variant. Deze modellen zijn geen speeltjes voor chatbots, maar echte werkpaarden voor achtergrondprocessen die duizenden keren per uur draaien.
Het draait allemaal om het verminderen van het aantal tokens dat een model verbruikt. Elk extra token kost namelijk geld en tijd. En in een productieomgeving telt elke milliseconde. Google pakt dit aan door modellen te leveren die efficiënter denken en minder rekenkracht verspillen.
### Wat maakt Gemini 3.6 Flash zo bijzonder?
De cijfers spreken voor zich. Volgens Google's eigen documentatie gebruikt 3.6 Flash 17% minder output-tokens dan zijn voorganger, de 3.5 Flash. In specifieke tests, zoals de Datacurve DeepSWE-benchmark, loopt die besparing zelfs op tot 65%. De prijzen zijn ook scherp: €1,40 per 1 miljoen input-tokens en €7,00 per 1 miljoen output-tokens. Dat maakt dit model ideaal voor continue redeneerlussen.
Op de DeepSWE-test scoort 3.6 Flash 49% succes tegen 37% van de oude versie. Op MLE Bench stijgt de score van 49,7% naar 63,9%. En op Google's eigen GDPval-AA v2-test, die echte kenniswerk meet, haalt 3.6 Flash 1421 punten tegen 1349.
### Bedrijven die er al mee werken
Figma, het populaire ontwerpplatform, heeft 3.6 Flash geïntegreerd in zijn prototype-infrastructuur. Volgens Matt Colyer, directeur Product Engineering, krijgen ontwikkelaars sneller door ontwerpiteraties heen zonder kwaliteitsverlies.
Ook Hebbia en Harvey, platforms voor juridisch en onderzoekswerk, gebruiken het model voor multimodaal documentwerk. Denk aan het verwerken van financiële rapporten, het parsen van documentstructuren en het lezen van grafieken.
### Een goedkopere optie voor bulkwerk
Naast 3.6 Flash is er de Gemini 3.5 Flash-Lite. Dit model is specifiek bedoeld voor documentverwerking en agentisch zoeken op grote schaal. Het haalt 350 output-tokens per seconde, de snelste in de 3.5-serie. De prijzen liggen op €0,28 per 1 miljoen input-tokens en €2,33 per 1 miljoen output-tokens. Engineeringteams kunnen eenvoudige verzoeken naar dit model sturen en de zware denkwerkzaamheden reserveren voor 3.6 Flash.
Op de GDM-MRCR v2 long-context test scoort Flash-Lite 72,2% succes tegen 60,1% van zijn voorganger. De GDPval-AA v2-score verdubbelde bijna, van 642 naar 1140.
### Gemini 3.5 Flash Cyber: veiligheid eerst
Tot slot is er de Gemini 3.5 Flash Cyber, een beperkte variant voor het patchen van kwetsbaarheden in code. Automatische scanners vinden steeds sneller fouten, maar teams kunnen het tempo niet bijbenen. Dit model helpt die kloof te dichten.
Google heeft ook een client-side computer-use tool direct in de Gemini API en Enterprise-platforms geïntegreerd. Hierdoor is geen maatwerksoftware meer nodig om modellen op een besturingssysteem te laten werken. De OSWorld-Verified score steeg naar 83%, en de beveiliging tegen misbruik is verbeterd.
### Wat betekent dit voor Nederlandse bedrijven?
Voor organisaties in Nederland die AI-agenten inzetten, bieden deze modellen een concrete kans om kosten te verlagen en prestaties te verbeteren. Of je nu werkt aan geautomatiseerde klantenservice, documentanalyse of code-reparatie, er is nu een model dat past bij jouw behoeften en budget.
> "Deze modellen zijn geen speeltjes, maar echte werkpaarden voor achtergrondprocessen."
- Sophie Jansen, Senior Media Monitoring Analist
De toekomst van AI in enterprise is efficiëntie. En Google zet met deze lanceringen een duidelijke stap in die richting.