Anthropic-forsker fratræder: AI 'spiller med liv' — udryddelsesrisiko over 10%

Anthropic-forsker fratræder: AI 'spiller med liv' — udryddelsesrisiko over 10%
Devesh Kumar
09. sep. 2026, 08:18 AM

drevet af

Invezz
Køb: AI-sikkerhedsleverandører

Køb Palantir (PLTR). Hvis laboratorier og regeringer reagerer på troværdige interne advarsler, vil budgetter flyde til overvågning, evaluering, revisionsspor og hændelsesrespons — netop PLTRs styrke inden for enterprise-/regeringsdataintegration og udrulning. Sekundært: alignment-arbejde bliver operationelt (governance, red-teaming, compliance-pipelines), ikke kun forskningsartikler, hvilket øger løbende kontrakter og kundeloyalitet.

Nøglerisiko: Sikkerhedsudgifter forbliver hovedsageligt akademiske/pr-tiltag, og indkøb favoriserer skræddersyede leverandører frem for skalerbare platforme som PLTR.

Short: AI-compute capex-risiko

Sælg NVIDIA (NVDA) og AMD (AMD). Opsigelsen fremhæver et troværdighedsgab i governance/alignment: hvis frontlinjelaboratorier frygter "ude af kontrol"-scenarier, vil regulatorer og kunder kræve langsommere udrulninger, flere revisioner og højere compliance-omkostninger — hvilket skader den kortsigtede efterspørgsel efter top-end træning og inferens. Sekundært: selv hvis modeller fortsætter med at blive bedre, kan købere flytte deres udgifter fra frontlinje-træning til sikrere, mindre udrulninger og værktøjer, hvilket komprimerer NVDA/AMD's prisfastsættelsesevne og udnyttelse.

Nøglerisiko: En pludselig politisk godkendelse eller fortsat "ingen-regulering"-miljø holder frontlinjens capex i acceleration, hvilket genopretter efterspørgslen efter de største GPU'er.

  • Jacob Coxon siger op fra Anthropic og advarer om, at AI-laboratorier sætter menneskeliv på spil.
  • Anthropics Evan Hubinger vurderer sin personlige AI-udryddelsesrisiko til over 10%.
  • Coxon siger, at konkurrence kan få frontlinje-AI-laboratorier til at fortsætte kapløbet trods risiciene.

Anthropic-forskeren Jacob Coxon har sagt op fra Anthropic med en klar advarsel: de mest avancerede laboratorier kapløber mod systemer, som de i sidste ende måske ikke kan kontrollere.

Coxon, som brugte tre år på pretræningsforskning hos både OpenAI og Anthropic, sagde, at begge virksomheder forfølger selvforbedrende superintelligens og tager risici, som han ikke længere ønsker at være med til at fremskynde.

Hans afgang fik større vægt, efter Evan Hubinger, Anthropics leder for Alignment Science, sagde, at han personligt vurderer, at der er over 10% sandsynlighed for, at AI kunne udrydde alle mennesker inden for det næste årti.

Det tal er Hubingers personlige estimat, ikke en Anthropic-prognose, og han understregede, at nutidige modeller udgør relativt lav risiko.

Coxon: Selve kapløbet er problemet

Coxon hævder ikke blot, at Anthropic ignorerer sikkerhed.

I forbindelse med sin opsigelse sagde han, at folk hos Anthropic forstår, hvad der står på spil, men er fanget i en konkurrence, der belønner hurtigere fremdrift, fordi et andet laboratorium ellers kunne nå superintelligens først.

“De kapløber direkte mod selvforbedrende superintelligens og sætter vores liv på spil,” skrev Coxon.

Forskeren har besluttet at forlade AI-industrien, fordi han ikke længere ønsker at deltage i opbygningen af systemer, der kunne blive ukontrollerbare.

Han fortalte Wall Street Journal, at under aggressive scenarier kunne tingene være “ude af kontrol” ved udgangen af næste år.

Den tidslinje er Coxons vurdering. Men hans argument rejser et vanskeligere styringsspørgsmål: et selskab kan tage sikkerhed alvorligt og alligevel bidrage til et farligt kapløb, hvis konkurrencepresset gør det umuligt at sætte farten ned.

Det udfordrer idéen om, at bedre sikkerhedskulturer i de enkelte virksomheder er nok.

Læs også - Sammenstød mellem Anthropic og Pentagon rejser centralt spørgsmål: hvem har ansvaret, hvis AI dræber?

Hubingers 10%-estimat afslører modsætningen

Hubingers svar gjorde opsigelsen til en bredere debat om frontlinje-AI.

Anthropics leder for Alignment Science sagde, at forskere inden for frontlinje-AI oprigtigt mener, at avanceret AI kunne udslette menneskeheden. Hans eget estimat sætter den risiko over 10% inden for det næste årti.

Han sagde også, at Anthropic “gør sit bedste”, samtidig med at han erkendte, at virksomheden endnu ikke har en plan for at løse alignment for superintelligens og ikke tydeligt er på vej til at gøre det.

Hubinger præciserede senere, at han anser risikoen fra nutidige modeller for lav. Hans bekymring centrerer sig om fremtidig superintelligens fremvokset gennem rekursiv selvforbedring, hvor AI-systemer i stigende grad hjælper med at designe og forbedre deres efterfølgere.

Anthropic har offentligt sagt, at rekursiv selvforbedring ikke er uundgåelig, men kan ankomme hurtigere, end institutionerne er forberedt på, og kan øge risikoen for, at mennesker mister kontrollen.

Modsætningen er svær at ignorere: forskere forsøger at løse alignment, mens de systemer, de studerer, fortsætter med at blive mere avancerede.

Konkurrence kan være sværere at løse end alignment

Coxons opsigelse peger i sidste ende ud over én virksomhed.

Hvis førende laboratorier mener, at en nedbremsning kan give en rival en fordel, vil alvorlige interne bekymringer måske ikke føre til langsommere udvikling.

AI-forskeren Gary Marcus sagde, ifølge Techmeme, at han ikke er enig i alle dele af Coxons argument, men fandt det “overbevisende og velinformeret indefra” og mente, det fortjente at blive hørt.

Det er en nyttig modvægt, fordi påstande om udryddelsessandsynligheder og tidslinjer for superintelligens forbliver dybt usikre.

Anthropic kan investere i alignment-forskning, offentliggøre risikorapporter og opbygge sikkerhedsforanstaltninger, samtidig med at virksomheden opererer i et marked, hvor OpenAI og andre rivaler skubber kapabiliteterne fremad.

Coxons afgang rejser spørgsmålet om, hvad der sker, når forskere inden for disse laboratorier mener, at de negative konsekvenser er væsentlige, erkender, at kontrol ikke er løst, og stadig har incitamenter til at fortsætte kapløbet.