Onderzoeker Anthropic neemt ontslag: AI 'gokt met levens'; uitstervingsrisico boven 10%

AI-sentiment: 18/100 Bearish
Deze score wordt gegenereerd op basis van een AI-gestuurde analyse van de inhoud van het artikel.
mogelijk gemaakt door
Koop Palantir (PLTR). Als laboratoria en overheden reageren op geloofwaardige interne waarschuwingen, vloeien budgetten naar monitoring, evaluatie, audit-trajecten en incidentrespons—precies de sterke punten van PLTR op het gebied van enterprise-/overheidsdata-integratie en -implementatie. Tweede-orde: alignment-werk wordt operationeel (governance, red-teaming, compliance-pijplijnen), niet alleen onderzoeksartikelen, wat terugkerende contracten en klantbinding vergroot.
Belangrijkste risico: Veiligheidsuitgaven blijven grotendeels academisch/PR-gericht en inkoop geeft de voorkeur aan maatwerkcontractors boven schaalbare platforms zoals PLTR.
Verkoop NVIDIA (NVDA) en AMD (AMD). Het ontslag benadrukt een geloofwaardigheidskloof op het gebied van governance en alignment: als voorhoedelaboratoria vrezend voor ‘buiten controle’-uitkomsten reageren, zullen regelgevers en klanten langzamere uitrol, meer audits en hogere compliancekosten eisen—wat de vraag op korte termijn naar high-end training en inferentie schaadt. Tweede-orde: zelfs als modellen blijven verbeteren, verschuiven kopers uitgaven van grensverleggende training naar veiligere, kleinere inzetvormen en tooling, waardoor NVDA/AMD's prijszettingskracht en benutting onder druk komen te staan.
Belangrijkste risico: Een plotselinge beleidsgoedkeuring of een aanhoudend 'geen-regulering'-klimaat houdt frontier-capex in versnelling en herstelt de vraag naar de grootste GPU's.
- Jacob Coxon verlaat Anthropic en waarschuwt dat AI-labs met mensenlevens gokken.
- Evan Hubinger van Anthropic schat het persoonlijke AI-uitstervingsrisico op meer dan 10%.
- Coxon zegt dat concurrentie ervoor kan zorgen dat voorhoede-AI-labs blijven racen ondanks de risico's.
Anthropic-onderzoeker Jacob Coxon heeft ontslag genomen bij Anthropic met een duidelijke waarschuwing: laboratoria aan de voorhoede racen op systemen af die ze uiteindelijk mogelijk niet kunnen beheersen.
Coxon, die drie jaar pretraining-onderzoek deed bij zowel OpenAI als Anthropic, zei dat beide bedrijven zelfverbeterende superintelligentie nastreven terwijl ze risico's nemen die hij niet langer wil helpen versnellen.
Zijn vertrek kreeg meer gewicht nadat Evan Hubinger, hoofd Alignment Science bij Anthropic, zei dat hij persoonlijk een kans van meer dan 10% ziet dat AI binnen het komende decennium de hele mensheid kan uitroeien.
Dat cijfer is Hubingers persoonlijke inschatting, geen Anthropic-voorspelling, en hij benadrukte dat huidige modellen relatief weinig risico vormen.
Coxon zegt dat de race zelf het probleem is
Coxon beweert niet simpelweg dat Anthropic veiligheid negeert.
Bij de aankondiging van zijn vertrek zei hij dat mensen bij Anthropic de potentiële inzet begrijpen maar gevangen blijven in een concurrentie die sneller bewegen beloont, omdat anders een ander laboratorium mogelijk als eerste superintelligentie bereikt.
“Ze rennen recht naar zelfverbeterende superintelligentie en gokken met ons leven,” schreef Coxon.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
De onderzoeker heeft besloten de AI-industrie te verlaten omdat hij niet langer wil meewerken aan het bouwen van systemen die oncontroleerbaar zouden kunnen worden.
Hij vertelde de Wall Street Journal dat onder agressieve scenario's het tegen het einde van volgend jaar "buiten controle" kan zijn.
Die tijdlijn blijft Coxons inschatting. Maar zijn betoog roept een moeilijkere governancevraag op: een bedrijf kan veiligheid serieus nemen en toch bijdragen aan een gevaarlijke race als concurrentiedruk vertragen onmogelijk doet lijken.
Dat daagt het idee uit dat betere veiligheidsculturen binnen afzonderlijke bedrijven voldoende zijn.
Hubingers 10%-inschatting legt de tegenstrijdigheid bloot
Hubingers reactie maakte van het vertrek een bredere discussie over AI aan de voorhoede.
Het hoofd van Alignment Science bij Anthropic zei dat onderzoekers binnen de voorhoede van AI oprecht geloven dat geavanceerde AI de mensheid kan uitroeien. Zijn eigen inschatting plaatst dat risico boven de 10% in het komende decennium.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
Hij zei ook dat Anthropic "zijn best doet", terwijl hij erkende dat het bedrijf nog geen plan heeft om alignment voor superintelligentie op te lossen en niet duidelijk op koers ligt om dat te doen.
Hubinger verduidelijkte later dat hij het risico van huidige modellen als laag beschouwt. Zijn zorg richt zich op toekomstige superintelligentie die ontstaat door recursieve zelfverbetering, waarbij AI-systemen in toenemende mate helpen bij het ontwerpen en verbeteren van hun opvolgers.
Anthropic heeft publiekelijk gezegd dat recursieve zelfverbetering niet onvermijdelijk is, maar eerder kan arriveren dan waarvoor instellingen zijn voorbereid en het risico kan vergroten dat mensen de controle verliezen.
De tegenstrijdigheid is moeilijk te negeren: onderzoekers proberen alignment op te lossen terwijl de systemen die ze bestuderen steeds krachtiger worden.
Concurrentie kan moeilijker op te lossen zijn dan alignment
Coxons vertrek wijst uiteindelijk verder dan één bedrijf.
Als toonaangevende laboratoria geloven dat vertragen een voorsprong aan een concurrent zou geven, vertaalt ernstige interne bezorgdheid zich mogelijk niet in langzamere ontwikkeling.
AI-onderzoeker Gary Marcus zei, in door Techmeme gerapporteerde opmerkingen, dat hij het niet eens was met elk onderdeel van Coxons betoog maar het "aansprekend en geïnformeerd van binnenuit" vond en zei dat het gehoord moest worden.
Dat is een nuttig tegenwicht omdat beweringen over uitstervingskansen en tijdlijnen voor superintelligentie diep onzeker blijven.
Anthropic kan investeren in alignment-onderzoek, risicorapporten publiceren en veiligheidsmaatregelen opzetten, terwijl het toch opereert in een markt waar OpenAI en andere concurrenten de mogelijkheden vooruit duwen.
Coxons vertrek stelt de vraag wat er gebeurt wanneer onderzoekers binnen die laboratoria geloven dat het nadeel materieel is, toegeven dat controle niet is opgelost en toch prikkels hebben om te blijven racen.

Qualcomm-aandelen stijgen 4% nadat Amazon tekent voor maatwerk AI-datacenterchips

Waarom Nvidia-aandelen vandaag meer dan 1% dalen terwijl AI-concurrenten stijgen

Micron-aandeel: kan verdubbeling van HBM-capaciteit leiden tot overaanbod?

Jensen Huang ziet AGI met OpenAI's Astra aankomen: 3 aandelen om te volgen

MiniMax stijgt 6%, Baidu +5%: waarom Astra van OpenAI de AI-golf in China aanjaagt
Geen resultaten gevonden
Artikelen laden...
Failed to load articles. Please try again.