Een AI vond een beveiligingsfout die alle andere modellen over het hoofd zagen
Googles Gemini 4 Argon ontdekte een kritieke kwetsbaarheid in ziekenhuissoftware die eerdere AI-modellen hadden gemist — een signaal dat AI-gedreven beveiligingsreview onmisbaar wordt.
- 68%
- op CWE-bench — gedeeld eerste in het oplossen van echte beveiligingsfouten
- 77,9%
- op DeepSWE v1.1 softwaretest
- 1M tokens
- contextvenster — leest volledige grote codebases in één keer
- 30 sept.
- lanceerdatum; beveiligingsverdedigers krijgen als eerste toegang
Beveiligingsbedrijf Wiz vond met Googles nieuwe Gemini 4 Argon een kritieke fout in software die in ziekenhuizen wereldwijd wordt gebruikt. Eerdere frontier-AI-modellen hadden dezelfde code gescand en de fout gemist. Deze AI vond wat andere AI niet kon. Die verschuiving — van handig naar onmisbaar — verandert hoe elk beveiligingsteam over de tools in zijn proces zou moeten nadenken.
Google lanceerde Argon op 30 september en gaf via het Fairwind-programma eerst toegang aan een beperkte groep — waaronder overheden en operators van kritieke infrastructuur. Het model is gebouwd voor lange, complexe taken: het opsporen van kwetsbaarheden, het reviewen van grote codebases, en juridische en financiële analyse. Het contextvenster verwerkt één miljoen uitvoertokens — tegenover 64.000 eerder — zodat het een volledige grote codebase in één doorgang leest. Op de CWE-bench beveiligingstest deelde het de eerste plaats met 68% — de beste score die een AI ooit haalde op dit meetpunt voor het oplossen van echte beveiligingsfouten.
De Fairwind-aanpak is doelbewust. Google geeft verdedigers toegang zonder de gebruikelijke beperkingen die in consumentenversies limiteren wat een AI mag analyseren. De logica is dezelfde als bij root-toegang voor een penetratietester: Volledig zicht is nodig om te vinden wat verborgen zit. Het is de eerste keer dat een groot AI-lab een beveiligingsgericht early-access-tier als formeel onderdeel van zijn lancering heeft opgezet.
Voor elk team dat software bouwt en uitbrengt, is het signaal praktisch. Een AI die miljoenen regels code in minuten leest en patronen markeert die eerdere tools misten, vervangt geen beveiligingsingenieur — het maakt er een sterker. Code-review zonder AI betekent nu dingen missen. Een volledige beveiligingsscan van je codebase uitvoeren kost een paar dollar per dag — de drempel om te beginnen is nog nooit zo laag geweest.