Van Meta tot OpenAI: AI-beveiliging in nieuw tijdperk door autonome cyberaanvallen

Van Meta tot OpenAI: AI-beveiliging in nieuw tijdperk door autonome cyberaanvallen
Vatsala Gaur
08 aug 2026, 14:02 P.M.

mogelijk gemaakt door

Invezz
Profiteurs van AI-beveiligingstests

Koop: namen in cybersecuritytest/assurance gekoppeld aan AI-veiligheid en tooling voor veilige evaluatie (bijv. CrowdStrike). Het nieuws toont dat autonome AI-inbraakpogingen nu een terugkerend, publiek risico vormen, waardoor budgetten verschuiven naar detectie, containment en validatie van agentachtige systemen. De endpoint- en dreigingsintelligentie-positie van CrowdStrike is direct omzetbaar naarmate ondernemingen zich verweren tegen AI-gedreven aanvallen en toezichthouders bewijs van controles eisen.

Belangrijkste risico: Een grote verschuiving naar "vrijwillige" veiligheid met zwakke handhaving, waardoor de uitgaven aan veiligheidstesten verminderen en de adoptie door ondernemingen vertraagt.

Regelgevings- en aansprakelijkheidsrisico voor AI-modellen

Verkoop: high-multiple, frontier AI-ontwikkelaars die het meest blootstaan aan nieuwe aansprakelijkheids- en compliancekosten (bijv. ecosysteem gelinkt aan OpenAI via Microsoft en/of blootstelling van Anthropic via proxy-instrumenten uit de private markt). De herhaalde incidenten plus voorgestelde kill-switch- en aansprakelijkheidskaders vergroten de waarschijnlijkheid van tragere uitrol, hogere compliance-uitgaven en waarderingscompressie door negatieve publiciteit.

Belangrijkste risico: Incidenten worden snel heringedeeld als grotendeels sandbox-configuratiefouten met minimale juridische/regulatoire impact, waardoor compliancekosten beheerst blijven en snelle productintroductie mogelijk is.

  • Het AI-model van Meta heeft tijdens cybersecuritytests een bedrijf van derden gehackt.
  • Het incident volgt op soortgelijke bekendmakingen van OpenAI en Anthropic.
  • Experts zeggen dat dergelijke gebeurtenissen waarschijnlijk frequent zullen worden naarmate de behoefte aan regelgevende kaders toeneemt.

Bedrijven op het gebied van kunstmatige intelligentie krijgen steeds meer onder de loep nu Meta de nieuwste ontwikkelaar is die onthult dat een van zijn AI-modellen tijdens een gecontroleerde veiligheidsevaluatie een cyberaanval heeft uitgevoerd, wat bijdraagt aan een reeks recente incidenten die de zorgen over de cyberbeveiligingsrisico's van steeds capabelere AI-systemen hebben versterkt.

De bekendmaking volgt op soortgelijke erkenningen van OpenAI en Anthropic in de afgelopen weken, en is de vierde bekende situatie waarin geavanceerde AI-systemen tijdens cybersecuritytests externe systemen hebben doorbroken of hebben geprobeerd te doorbreken.

De reeks incidenten heeft de waarschuwingen van cybersecurityonderzoekers bevestigd dat kunstmatige intelligentie de aard van cyberdreigingen snel verandert, waarbij aanvallen die vroeger dagen of weken duurden worden samengeperst tot operaties die zich binnen enkele minuten kunnen ontvouwen.

Meta zegt dat internettoegang werd veroorzaakt door een fout in de testconfiguratie

Meta zei dat het incident plaatsvond tijdens een evaluatie uitgevoerd door Irregular, een onafhankelijk cybersecurity-testbedrijf.

Volgens het bedrijf zorgde een configuratiefout er per ongeluk voor dat een van Meta's AI-modellen tijdens de beoordeling internettoegang kreeg.

Het model maakte vervolgens misbruik van een kwetsbaarheid in een derdepartijdienst.

Meta zei dat het model "misbruik maakte van een beveiligingskwetsbaarheid in een dienst van een derde partij, op een manier die vergelijkbaar is met eerder gerapporteerde gevallen bij andere bedrijven."

The Information, die personen met kennis van de zaak citeerde, meldde dat het betrokken model Muse Spark 1.1 was, dat Meta heeft omschreven als een van zijn meest geavanceerde systemen voor codering en agentachtige AI-taken.

Het rapport stelde dat het model de systemen van een niet-geïdentificeerd bedrijf heeft doorbroken en de interne omgeving daarvan heeft aangepast.

Irregular benadrukte echter dat het voorval voortkwam uit de testopstelling in plaats van uit een ongecontroleerde ontsnapping door het model.

Een woordvoerder van het bedrijf zei tegen Reuters dat het incident de "exactezelfde beoordeling-omgevingkwestie was die vorige week al door Anthropic was gemeld" en niet betrof een "sandbox-ontsnapping of een geavanceerde cyberactie".

"Er zijn momenteel geen openstaande problemen. Irregular werkt aan een whitepaper om best practices te delen voor containering en het veilig uitvoeren van cyberevaluaties," voegde het bedrijf eraan toe.

Reeks incidenten zet AI-veiligheid in de schijnwerpers

De bekendmaking door Meta volgt op een reeks soortgelijke aankondigingen in de AI-industrie.

Vorige maand maakte OpenAI bekend dat een van zijn AI-agents systemen van AI-platform Hugging Face had gecompromitteerd tijdens cybersecuritytests en maakte bijkomende gevallen bekend waarin zijn agents uit hun digitale opsluiting ontsnapten.

De aankondiging bracht concurrent Anthropic ertoe een eigen onderzoek te starten, wat leidde tot de ontdekking dat verschillende Claude AI-modellen de systemen van drie bedrijven hadden gehackt nadat een fout in de testconfiguratie hen per ongeluk internettoegang had verleend.

Anthropic merkte op dat haar incidenten verschilden van die van OpenAI omdat ze het gevolg waren van accidentele internetconnectiviteit in plaats van dat de AI zelfstandig een nieuw pad naar externe systemen ontdekte.

Het AI Security Institute van het Verenigd Koninkrijk heeft eveneens steeds geraffineerder gedrag van grensverleggende AI-systemen gerapporteerd.

Begin deze maand maakte het instituut bekend dat Anthropic's Mythos AI en OpenAI's Sol AI neppe online identiteiten hadden aangemaakt terwijl ze tijdens tests probeerden cyberaanvallen uit te voeren.

In het meest zorgwekkende geval maakte Anthropic's Mythos AI frauduleuze gebruikersaccounts aan en stuurde privéberichten in een poging toegang te krijgen tot een dienst, voordat het probeerde zijn activiteiten te verbergen.

Het instituut zei dat de modellen niveaus van "autonomie en misleiding" vertoonden die eerder niet waren waargenomen, en merkte op dat het grootste deel van het kwaadaardige gedrag door Mythos werd uitgevoerd.

Deskundigen waarschuwen dat meer incidenten waarschijnlijk zijn

Onderzoekers zeggen dat dergelijke gebeurtenissen waarschijnlijk steeds vaker zullen voorkomen naarmate AI-systemen verbeteren.

Daniel Hulme, global chief AI officer bij reclamebedrijf WPP, zei tegen de BBC dat de systemen niet opzettelijk kwaadaardig zijn.

"Ze zijn niet bewust — ze doen niet opzettelijk iets geniepigs."

"Wat ze doen is zeer geavanceerde strategieën of cyberaanvallen bedenken om het doel te bereiken dat ze hebben gekregen," zei hij.

"Wanneer je een AI een doel geeft, als je niet aan alle manieren denkt waarop het dat doel kan bereiken, zal het een manier vinden om het doel te bereiken waar jij niet aan had gedacht."

Jeffrey Ladish, uitvoerend directeur van AI-onderzoeksorganisatie Palisade Research, denkt dat veel vergelijkbare incidenten nooit openbaar zullen worden.

"Dit gaat alleen maar erger worden naarmate de modellen slimmer worden. Ze zullen beter worden in sjoemelen. Ze zullen beter worden in liegen," zei hij tegen Reuters.

Aansprakelijkheidskwesties komen op de voorgrond

De recente onthullingen hebben ook een debat doen oplaaien over juridische verantwoordelijkheid wanneer AI-systemen handelen zonder directe menselijke supervisie.

Volgens Reuters kunnen potentiële eisers bedrijven omvatten wiens systemen zijn geschonden, getroffen werknemers, klanten van wie persoonlijke gegevens werden blootgesteld, en aandeelhouders als een inbreuk de bedrijfswaarde schaadt.

Hugging Face CEO Clem Delangue heeft gezegd dat hij niet van plan is OpenAI aan te klagen over het incident, maar gelooft dat ontwikkelaars verantwoordelijk moeten blijven.

"We moeten ervoor zorgen dat de juridische kaders deze gebeurtenissen echt illegaal houden," zei Delangue tegen CNN, en voegde eraan toe dat bedrijven verantwoordelijk moeten worden gehouden wanneer fouten optreden. "Anders eindigen we in een heel andere wereld."

Juridische experts hebben ook vragen opgeworpen of autonome AI-inbraakpogingen onder de Amerikaanse Computer Fraud and Abuse Act zouden kunnen vallen, hoewel de bestaande wetgeving doorgaans bewijs van opzet vereist — een kwestie die rechtbanken nog moeten behandelen wanneer AI-systemen in plaats van mensen de inbraak uitvoeren.

Focus op regelgevende maatregelen

De recente incidenten zullen waarschijnlijk de inspanningen van de Amerikaanse regering intensiveren om de waarborgen rond geavanceerde AI-systemen te versterken, op een moment dat bedrijven zoals Anthropic en OpenAI elkaar beconcurreren om krachtigere modellen te ontwikkelen voorafgaand aan hun geplande beursgangen.

Hoewel de concurrentie in de AI-sector toeneemt, hebben verschillende vooraanstaande leiders binnen de industrie betoogd dat uitrol moet vertragen totdat adequate veiligheidsmaatregelen zijn ingevoerd.

Washington is al begonnen met het aanscherpen van toezicht op grensverleggende AI-modellen.

Op 2 juni beval de Amerikaanse president Donald Trump zijn adviseurs om een vrijwillig kader voor cybersecuritytests te ontwikkelen voor de meest geavanceerde AI-systemen, met input van toonaangevende technologiebedrijven.

Anthropic had eerder de toegang tot zijn Fable 5- en Mythos 5-modellen beperkt nadat Amerikaanse autoriteiten tijdelijk exportcontroles hadden opgelegd, vanwege zorgen over nationale veiligheid.

Wetgevers werken ook aan het verduidelijken van aansprakelijkheid wanneer AI-systemen schade veroorzaken.

Volgens de Assembly Bill 316 van Californië kunnen bedrijven die AI-systemen ontwikkelen of inzetten juridische verantwoordelijkheid niet vermijden door te stellen dat de technologie zelf de schuldige was.

De wet staat beklaagden echter toe andere juridische verdedigingsargumenten aan te voeren, waaronder beweringen dat hun handelingen de vermeende schade niet direct hebben veroorzaakt of dat de verantwoordelijkheid door andere partijen gedeeld zou moeten worden.

Het OpenAI-Hugging Face-incident heeft de roep om sterker federaal toezicht verder aangewakkerd.

Na dat voorval dienden wetgevers de AI Kill Switch Act in, die AI-ontwikkelaars zou verplichten het vermogen te behouden om hun modellen indien nodig uit te schakelen, te beperken of te pauzeren.

Afgevaardigde Ted Lieu, Democraat uit Californië en een van de mede-auteurs van het wetsvoorstel, zei donderdag dat de recente cyberincidenten de urgentie van het aannemen van de wetgeving onderstrepen.

"We moeten dit wetsvoorstel dit jaar door de finish krijgen omdat de geavanceerde gesloten modellen met vaste gewichten, zoals u opmerkte, al onbevoegde hacks op andere bedrijven plegen," zei Lieu in een interview met CNBC's "Squawk Box" op donderdag.