Cyberverdedigers krijgen Gemini 4 Argon eerst
Google heeft deze week Gemini 4 Argon aangekondigd, een nieuw frontiermodel voor complexe, langdurige taken op het gebied van softwareontwikkeling, kenniswerk in bedrijven en cybersecurity. Zelf uitproberen kan nog niet. Argon gaat eerst naar een selecte groep vertrouwde cybersecurityspecialisten via het Fairwind-programma, naast interne Google-teams.
Voor die groep laat Google de cyberguardrails weg. Het model kan daardoor volgens Google zelfstandig kwetsbaarheden in software opsporen, valideren en herstellen, zonder de beperkingen die een publieke versie wel zou krijgen.
Hun beveiligingsbedrijf Wiz zegt dat Argon een kritieke kwetsbaarheid vond in zorgsoftware die ziekenhuizen wereldwijd gebruiken. Google wil de beveiliging tegen misbruik eerst verder aanscherpen, onder meer tegen cyberaanvallen en aanvallen met chemische, biologische, radiologische en nucleaire middelen. Het doet denken aan Anthropic dat Claude Mythos Preview eveneens voorbehouden houdt aan een kleine groep organisaties binnen Project Glasswing.
Na de beveiligers volgen ontwikkelaars, bedrijven en consumenten, te beginnen met betalende api-klanten en abonnees van Google ai Ultra. Een datum noemt Google niet. De introductieprijs bedraagt twee dollar per miljoen invoertokens en tien dollar per miljoen uitvoertokens. De outputlimiet gaat naar één miljoen tokens, tegenover 64.000 bij de vorige generatie, zodat het model langer kan ‘nadenken’ voordat het antwoordt.
Cijfers van Google zelf
Google strooit ook met cijfers als het om Gemini 4 Argon gaat. Argon scoort 77,9 procent op DeepSWE v1.1, een test met realistische, langdurige programmeertaken, en 91,7 procent op LVBench, voor het begrijpen van lange video’s.
Op CWE-bench v1, waarin modellen beveiligingslekken moeten herstellen, deelt het model met 68 procent de eerste plaats. Het gaat om cijfers die Google zelf aanhaalt.
