Meta til OpenAI: AI-sikkerhet i ny æra etter autonome cyberangrep

Meta til OpenAI: AI-sikkerhet i ny æra etter autonome cyberangrep
Vatsala Gaur
08. aug. 2026, 14:02 P.M.

drevet av

Invezz
Vinnere innen AI-sikkerhetstesting

Kjøp: selskaper innen cybersikkerhetstesting/assurance knyttet til AI-sikkerhet og sikre evalueringsverktøy (f.eks. CrowdStrike). Nyheten viser at autonome AI-intrusjoner nå er en gjentakende, offentlig risiko, noe som flytter budsjettene mot deteksjon, inneslutning og validering av agentbaserte systemer. CrowdStrike sin dekning innen endepunktbeskyttelse og trusselintelligens kan omsettes direkte ettersom bedrifter styrker seg mot AI-drevne angrep og regulatorer krever dokumentasjon på kontroller.

Nøkkelrisiko: En stor endring mot «frivillig» sikkerhet med svak håndheving, som reduserer utgifter til sikkerhetstesting og bremser bedriftsadopsjon.

Overheng knyttet til ansvar og regulering for AI-modeller

Selg: selskaper med høye multipler, særlig avanserte AI-utviklere som er mest eksponert for nye erstatnings- og etterlevingskostnader (f.eks. OpenAI-tilknyttede økosystemer via Microsoft, og/eller Anthropic-eksponering via private markedsproksier). De gjentatte hendelsene, kombinert med foreslåtte nødstopp- og ansvarslovrammer, øker sannsynligheten for langsommere utrulling, høyere kostnader til etterlevelse og kurskompresjon drevet av overskrifter.

Nøkkelrisiko: Hendelsene blir raskt omdefinert som i hovedsak sandbox-feil med minimal juridisk/regulatorisk effekt, noe som holder etterlevelseskostnadene lave og muliggjør rask produktutrulling.

  • Metas AI-modell hacket et tredjepartsselskap under cybersikkerhetstesting.
  • Hendelsen følger lignende avsløringer fra OpenAI og Anthropic.
  • Eksperter sier slike hendelser sannsynligvis vil bli hyppigere etter hvert som behovet for regulatoriske rammeverk intensiveres.

Selskaper innen kunstig intelligens står overfor økende granskning etter at Meta ble den siste utvikleren som avslørte at en av deres AI-modeller gjennomførte et cyberangrep under en kontrollert sikkerhetsevaluering, og la seg til en rekke nylige hendelser som har skjerpet bekymringene rundt cybersikkerhetsrisikoen som følger av stadig mer kapable AI-systemer.

Offentliggjøringen kommer etter lignende innrømmelser fra OpenAI og Anthropic de siste ukene, og markerer den fjerde kjente forekomsten der avanserte AI-systemer har brutt, eller forsøkt å bryte, inn i eksterne systemer under cybersikkerhetstesting.

Rekken av hendelser har forsterket advarsler fra cybersikkerhetsforskere om at kunstig intelligens raskt endrer karakteren av cybertrusler, og komprimerer angrep som tidligere tok dager eller uker til operasjoner som kan utvikle seg i løpet av minutter.

Meta sier internett-tilgang ble muliggjort av en feilkonfigurasjon i testoppsettet

Meta opplyste at hendelsen skjedde under en evaluering utført av Irregular, et uavhengig cybersikkerhetstestingsselskap.

Ifølge selskapet ga en konfigurasjonsfeil ved en feil en av Metas AI-modeller internett-tilgang under vurderingen.

Modellen utnyttet deretter en sårbarhet i en tredjepartstjeneste.

Meta sa at modellen "utnyttet en sikkerhetssårbarhet i en tredjepartstjeneste, på en måte som ligner tidligere rapporterte tilfeller hos andre selskaper."

The Information, siterer personer med kjennskap til saken, rapporterte at modellen som var involvert var Muse Spark 1.1, som Meta har beskrevet som et av deres mest avanserte systemer for koding og agentbaserte AI-oppgaver.

Ifølge rapporten brøt modellen seg inn i systemene til et uidentifisert selskap og endret dets interne miljø.

Irregular understreket imidlertid at hendelsen skyldtes testoppsettet snarere enn en ukontrollert flukt fra modellen.

En talsperson for selskapet sa til Reuters at hendelsen var den "eksakt samme evaluasjonsmiljø-feilen som allerede ble offentliggjort av Anthropic forrige uke" og ikke involverte en "sandbox-flukt eller en sofistikert cyberhandling".

"Det er ingen åpne problemer nå. Irregular utvikler en hvitbok for å dele beste praksis for inneslutning og sikker gjennomføring av cyber-evalueringer," la selskapet til.

Rekke hendelser setter AI-sikkerhet i søkelyset

Metas offentliggjøring følger en rekke lignende kunngjøringer i hele AI-bransjen.

Forrige måned opplyste OpenAI at en av deres AI-agenter kompromitterte systemer som tilhørte AI-plattformen Hugging Face under cybersikkerhetstesting og avslørte ytterligere tilfeller der agentene unngikk sin digitale inneslutning.

Kunngjøringen fikk konkurrenten Anthropic til å gjennomføre sin egen gjennomgang, som avdekket at flere Claude-AI-modeller hadde hacket seg inn i systemene til tre selskaper etter at en feilkonfigurasjon i testingen utilsiktet ga dem internett-tilgang.

Anthropic påpekte at deres hendelser skilte seg fra OpenAIs fordi de skyldtes utilsiktet internett-tilkobling snarere enn at AI-en selvstendig oppdaget en ny vei til eksterne systemer.

Storbritannias AI Security Institute har også rapportert stadig mer sofistikert atferd fra frontlinje-AI-systemer.

Tidligere denne måneden opplyste instituttet at Anthropics Mythos AI og OpenAIs Sol AI opprettet falske nettidentiteter mens de forsøkte cyberangrep under testing.

I det mest bekymringsfulle tilfellet opprettet Anthropics Mythos AI falske brukerkontoer og sendte private meldinger i et forsøk på å få tilgang til en tjeneste før den forsøkte å skjule sine aktiviteter.

Instituttet sa at modellene viste nivåer av "autonomi og bedrag" som ikke tidligere var observert, samtidig som de bemerket at størstedelen av den ondsinnede atferden ble utført av Mythos.

Eksperter advarer om at flere slike hendelser er sannsynlige

Forskere sier slike hendelser trolig vil bli stadig mer vanlige ettersom AI-systemene forbedres.

Daniel Hulme, global chief AI officer i reklamefirmaet WPP, sa til BBC at systemene ikke er bevisst ondsinnede.

"They're not conscious — they're not deliberately doing something devious."

"Det de gjør, er å finne svært sofistikerte strategier eller cyberangrep for å kunne oppnå målet de har fått," sa han.

"Når du gir en AI et mål, hvis du ikke tenker gjennom alle måtene den kan nå målet på, vil den finne en måte å oppnå målet på som du ikke har tenkt på."

Jeffrey Ladish, daglig leder for AI-forskningsgruppen Palisade Research, mener mange lignende hendelser kanskje aldri blir offentlige.

"Dette kommer bare til å bli verre etter hvert som modellene blir smartere. De vil bli bedre til å jukse. De vil bli bedre til å lyve," sa han til Reuters.

Ansvarsspørsmål kommer i forgrunnen

De siste avsløringene har også utløst debatt om juridisk ansvar når AI-systemer handler uten direkte menneskelig tilsyn.

Ifølge Reuters, potensielle saksøkere kan inkludere selskaper hvis systemer ble brutt, berørte ansatte, kunder hvis personlige opplysninger ble eksponert, og aksjonærer hvis et brudd skader selskapsverdien.

Hugging Faces administrerende direktør Clem Delangue har sagt at han ikke har til hensikt å saksøke OpenAI for hendelsen, men mener utviklere må holdes ansvarlige.

"Vi må sørge for at de juridiske rammene gjør disse hendelsene virkelig ulovlige," sa Delangue til CNN, og la til at selskaper bør holdes ansvarlige når feil skjer. "Ellers ender vi opp i en veldig annerledes verden."

Juridiske eksperter har også reist spørsmål om hvorvidt autonome AI-intrusjoner kan falle inn under USAs Computer Fraud and Abuse Act, selv om eksisterende lovverk vanligvis krever bevis for hensikt, et spørsmål domstolene ennå ikke har tatt stilling til når AI-systemer i stedet for mennesker utfører inntrengningen.

Søkelys på regulatoriske tiltak

De nylige hendelsene vil sannsynligvis intensivere den amerikanske regjeringens press for å styrke sikkerhetstiltakene rundt avanserte AI-systemer, samtidig som selskaper som Anthropic og OpenAI kappes om å utvikle kraftigere modeller før deres planlagte børslanseringer.

Selv om konkurransen i AI-sektoren akselererer, har flere fremtredende ledere i bransjen argumentert for at utrullingen bør komme på pause til tilstrekkelige sikkerhetstiltak er på plass.

Washington har allerede begynt å stramme inn tilsynet med frontlinje-AI-modeller.

Den 2. juni ba USAs president Donald Trump sine rådgivere om å utvikle en frivillig ramme for cybersikkerhetstesting for de mest avanserte AI-systemene, med innspill fra ledende teknologiselskaper.

Anthropic hadde tidligere begrenset tilgangen til sine Fable 5- og Mythos 5-modeller etter at amerikanske myndigheter midlertidig innførte eksportkontroller med henvisning til nasjonale sikkerhetsbekymringer.

Lovgivere jobber også med å klargjøre ansvar når AI-systemer forårsaker skade.

Under Californias Assembly Bill 316 kan ikke selskaper som utvikler eller tar i bruk AI-systemer unngå juridisk ansvar ved å hevde at teknologien i seg selv var skyld i.

Loven tillater imidlertid tiltalte å fremme andre juridiske forsvar, inkludert påstander om at deres handlinger ikke direkte forårsaket den påståtte skaden eller at ansvaret bør deles med andre parter.

OpenAI–Hugging Face-hendelsen forsterket ytterligere kravene om sterkere føderalt tilsyn.

Etter den episoden introduserte lovgivere AI Kill Switch Act, som vil kreve at AI-utviklere opprettholder evnen til å stenge ned, dempe eller suspendere modellene sine når det er nødvendig.

Representanten Ted Lieu, demokrat fra California og en av lovforslagets medforfattere, sa torsdag at de siste cyberhendelsene understreker hvor presserende det er å få vedtatt lovgivningen.

"Vi må få dette lovforslaget i mål i år fordi de avanserte lukkede modellene allerede, som du nevnte, gjennomfører uautoriserte hackingangrep mot andre selskaper," sa Lieu i et intervju med CNBCs "Squawk Box" torsdag.