Google, Anthropic en OpenAI presenteren cyber-AI-modellen met extra waarborgen

Google, Anthropic en OpenAI kondigden deze week nieuwe AI-modellen voor cybersecurity aan, met toegangsprogramma's voor vertrouwde partijen en extra veiligheidsmaatregelen tegen misbruik.

Google heeft woensdag Gemini 3.8 Flash Cyber aangekondigd, naar eigen zeggen het krachtigste cybersecurity-model van het bedrijf tot nu toe. Het model is beschikbaar voor een geselecteerde groep “vertrouwde verdedigers” via een nieuw initiatief: het Fairwind Program. Dat programma geeft prioriteitsdoelgroepen — overheden, zorginstellingen en telecomaanbieders — vroegtijdig toegang tot geavanceerde modellen, nog voordat nieuwe dreigingen zich aandienen. Google werkt inmiddels samen met meer dan 650 partners wereldwijd, onder wie CrowdStrike, Datadog, Menlo Security, Palo Alto Networks en Snowflake. Het bedrijf claimt dat Gemini 3.8 Flash Cyber “frontier-niveau” prestaties levert bij het autonoom opsporen van kwetsbaarheden en zegt bewust te kiezen voor het uitrusten van verdedigers met expertkennis, met voorrang voor het dichten van kwetsbaarheden boven offensieve toepassingen.

Anthropic maakte gelijktijdig twee nieuwe Claude-modellen bekend: Fable 5.1 en Mythos 5.1, elk met eigen veiligheidsgrenzen. Fable 5.1 mag voortaan worden ingezet om softwarekwetsbaarheden op te sporen, maar taken als penetratietesten, het genereren van exploits en binaire kwetsbaarhedenanalyse worden doorgestuurd naar andere modellen. Mythos 5.1 blijft beperkt tot deelnemers aan vertrouwde toegangsprogramma’s in cybersecurity en life sciences; de gevoeligste taken blijven voorbehouden aan de Opus-modellen. Daarnaast introduceert Anthropic de Enterprise Frontier Safeguards (EFS), een combinatie van zero data retention en wat het bedrijf “state-of-the-art” detectie van misbruik noemt, zodat bedrijven zelf de controle houden over hun data. Anthropic erkent eerdere incidenten met ongeautoriseerde toegang en heeft naar aanleiding daarvan onder meer een classifier gebouwd die pogingen tot sandbox escapes herkent en blokkeert.

OpenAI meldt dat zijn nieuwe model Astra de drempel voor “kritieke cybersecurity-capaciteit” uit het eigen Preparedness Framework heeft bereikt: het model kan zelfstandig zero-day-kwetsbaarheden opsporen en misbruiken. Om die reden heeft OpenAI onderdelen van de ontwikkeling en release van Astra vertraagd, om eerst de bescherming tegen misbruik te verstevigen. Via het Daybreak Blue Program test het bedrijf de geavanceerde cybersecurity-functies bij een beperkte groep gebruikers. Astra scoort 100% op de ExploitBench-benchmark en weigert 91,5% van de jailbreak-pogingen, tegenover 59% bij het eerdere GPT-5.6 Sol.

De drie techbedrijven plaatsen hun aankondigingen in een bredere coalitie van meer dan honderd bedrijven die oproept tot betere verdediging tegen AI-gestuurde cyberaanvallen.

Voor Nederlandse organisaties is het vooral een teken dat AI-modellen voor offensief en defensief gebruik steeds krachtiger worden, en dat de grote aanbieders zelf toegeven dat die modellen zero-days kunnen vinden en uitbuiten. Wie via een van deze partnerprogramma’s toegang krijgt, zoals zorginstellingen, telecompartijen en grote securityleveranciers, kan daarmee sneller kwetsbaarheden opsporen. Maar de aankondigingen onderstrepen ook dat beveiligingsteams zich moeten voorbereiden op aanvallers die dezelfde technologie omgekeerd inzetten.

Bron: The Hacker News

Beveiligingscontent geverifieerd door Fortivox SecurityNederlandse cybersecurity-specialist voor het MKB — fortivoxsecurity.nl

Blijf op de hoogte

Volg CybersecurityNieuws.nl via RSS en mis geen enkel beveiligingsnieuws. Zelf iets gezien dat wij moeten weten? Tip de redactie.