Badacz Anthropic rezygnuje: AI „hazarduje życiem”; ryzyko wyginięcia >10%

Sentyment AI: 18/100 Niedźwiedzi
Ten wynik jest generowany na podstawie analizy treści artykułu napędzanej sztuczną inteligencją.
Wspierane przez
Kup Palantir (PLTR). Jeśli laboratoria i rządy zareagują na wiarygodne wewnętrzne ostrzeżenia, budżety popłyną na monitoring, ewaluację, ścieżki audytu i reagowanie na incydenty — czyli właśnie na mocne strony PLTR w integracji danych i wdrożeniach dla przedsiębiorstw i administracji. Efekt drugorzędny: prace nad alignmentem staną się operacyjne (zarządzanie, red-teamingu, procesy zgodności), a nie tylko publikacjami badawczymi, zwiększając kontrakty powtarzalne i przywiązanie klientów.
Kluczowe ryzyko: Wydatki na bezpieczeństwo pozostają głównie akademickie/PR-owe, a zamówienia faworyzują wykonawców na zamówienie zamiast skalowalnych platform takich jak PLTR.
Sprzedaj NVIDIA (NVDA) i AMD (AMD). Rezygnacja uwypukla lukę w wiarygodności dotyczącą zarządzania/alignacji: jeśli laboratoria obawiają się wyników „poza kontrolą”, regulatorzy i klienci będą żądać wolniejszych wdrożeń, większej liczby audytów oraz wyższych kosztów zgodności — co osłabi popyt krótko- i średnioterminowy na najwyższej klasy szkolenia/inferencję. Efekt drugorzędny: nawet jeśli modele będą się nadal poprawiać, nabywcy przeniosą wydatki z treningów frontierowych na bezpieczniejsze, mniejsze wdrożenia i narzędzia, ograniczając siłę cenową NVDA/AMD i ich wykorzystanie.
Kluczowe ryzyko: Nagłe zielone światło polityczne lub utrzymanie środowiska „brak regulacji” przyspiesza nakłady frontierowe, przywracając popyt na największe GPU.
- Jacob Coxon odchodzi z Anthropic, ostrzegając, że laboratoria AI hazardują ludzkimi życiami.
- Evan Hubinger z Anthropic ocenia swoje osobiste ryzyko wyginięcia z powodu AI na ponad 10%.
- Coxon twierdzi, że konkurencja może sprawić, iż laboratoria zajmujące się zaawansowaną AI będą dalej prowadzić wyścig pomimo ryzyka.
Badacz Anthropic Jacob Coxon zrezygnował z pracy w Anthropic, wysyłając ostre ostrzeżenie: laboratoria pracujące nad przełomowymi systemami AI pędzą w stronę systemów, którymi ostatecznie mogą nie być w stanie zapanować.
Coxon, który przez trzy lata prowadził badania nad wstępnym treningiem modeli w OpenAI i Anthropic, powiedział, że obie firmy dążą do samodoskonalącej się superinteligencji, podejmując ryzyka, których już nie chce przyspieszać.
Jego odejście nabrało znaczenia po tym, jak Evan Hubinger, kierownik ds. badań nad alignmentem w Anthropic, stwierdził, że osobiście ocenia ponad 10% szans, że AI mogłoby zabić wszystkich ludzi w ciągu następnej dekady.
Ta liczba to własna ocena Hubingera, a nie prognoza Anthropic; podkreślił przy tym, że obecne modele stwarzają stosunkowo niskie ryzyko.
Coxon: sam wyścig jest problemem
Coxon nie twierdzi po prostu, że Anthropic ignoruje bezpieczeństwo.
Ogłaszając rezygnację, powiedział, że osoby w Anthropic rozumieją potencjalne stawki, ale pozostają uwikłane w konkurencję, która nagradza szybsze tempo, ponieważ w przeciwnym razie inne laboratorium mogłoby jako pierwsze osiągnąć superinteligencję.
„Pędzą prosto w stronę samodoskonalącej się superinteligencji i hazardują naszym życiem” — napisał Coxon.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Badacz postanowił opuścić branżę AI, ponieważ nie chce już uczestniczyć w tworzeniu systemów, które mogłyby stać się niekontrolowalne.
Powiedział Wall Street Journal, że w agresywnych scenariuszach sytuacja może być „poza kontrolą” do końca przyszłego roku.
Ten harmonogram pozostaje oceną Coxona. Jednak jego argument stawia trudniejsze pytanie o zarządzanie: firma może traktować bezpieczeństwo poważnie, a mimo to przyczyniać się do niebezpiecznego wyścigu, jeśli presja konkurencyjna sprawia, że zwolnienie tempa wydaje się niemożliwe.
To podważa przekonanie, że lepsza kultura bezpieczeństwa w pojedynczych firmach wystarczy.
Przeczytaj także — Starcie Anthropic z Pentagonem stawia kluczowe pytanie: kto ponosi winę, jeśli AI zabije?
Ocena 10% Hubingera ujawnia sprzeczność
Reakcja Hubingera zamieniła rezygnację w szerszą debatę o przełomowej AI.
Szef zespołu ds. nauki o alignmentie w Anthropic powiedział, że badacze w obszarze przełomowej AI rzeczywiście uważają, że zaawansowana AI mogłaby zabić ludzkość. Jego własna ocena stawia to ryzyko powyżej 10% w ciągu następnej dekady.
Jacob is correct here—we really do earnestly believe AI could kill all humans! I personally think it is >10% within the next decade. I believe Anthropic is trying its best, but we do not yet have a plan to solve alignment for superintelligence and are not clearly on track to. https://t.co/QAIHiFP3QZ
— Evan Hubinger (@EvanHub) September 9, 2026
Dodał też, że Anthropic „robi, co w jego mocy”, przyznając jednocześnie, że firma nie ma jeszcze planu na rozwiązanie problemu alignmentu dla superinteligencji i nie jest jasne, czy jest na właściwej drodze, by tego dokonać.
Hubinger później doprecyzował, że uważa ryzyko ze strony obecnych modeli za niskie. Jego obawy dotyczą przyszłej superinteligencji powstającej poprzez rekursywne samodoskonalenie, w którym systemy AI coraz częściej pomagają projektować i ulepszać swoje następne wersje.
Anthropic publicznie stwierdził, że rekursywne samodoskonalenie nie jest nieuchronne, ale może pojawić się szybciej, niż instytucje są na to przygotowane, i może zwiększyć ryzyko utraty kontroli przez ludzi.
Sprzeczności trudno zignorować: badacze próbują rozwiązać problem alignmentu, podczas gdy systemy, które badają, stają się coraz bardziej zdolne.
Konkurencję może być trudniej rozwiązać niż problem alignmentu
Rezygnacja Coxona ostatecznie wykracza poza jedną firmę.
Jeśli wiodące laboratoria wierzą, że zwolnienie tempa mogłoby dać przewagę rywalowi, poważne wewnętrzne obawy mogą nie przełożyć się na wolniejszy rozwój.
Badacz AI Gary Marcus powiedział, w komentarzach cytowanych przez Techmeme, że nie zgadza się z każdym elementem argumentu Coxona, ale uznał go za „przekonujący i oparty na wiedzy od środka” oraz za zasługujący na wysłuchanie.
To użyteczna przeciwwaga, ponieważ twierdzenia o prawdopodobieństwie wyginięcia i harmonogramach osiągnięcia superinteligencji pozostają głęboko niepewne.
Anthropic może inwestować w badania nad alignmentem, publikować raporty o ryzyku i budować zabezpieczenia, jednocześnie działając na rynku, gdzie OpenAI i inni rywale posuwają możliwości naprzód.
Odejście Coxona stawia pytanie, co się dzieje, gdy badacze w tych laboratoriach uważają, że potencjalne straty są istotne, przyznają, że kontrola nie jest rozwiązana, a mimo to mają motywacje, by dalej prowadzić wyścig.

Akcje Qualcomma rosną o 4% po umowie z Amazonem na układy AI dla centrów danych

Dlaczego akcje Nvidii spadły dziś ponad 1%, mimo zwyżek konkurentów AI

Akcje Micron: czy podwojenie mocy HBM może wywołać efekt nadpodaży?

Jensen Huang: AGI nadchodzi z Astra OpenAI — 3 akcje warte uwagi inwestorów

MiniMax +6%, Baidu +5%: dlaczego Astra OpenAI napędza chiński boom AI
Nie znaleziono wyników
Ładowanie artykułów...
Failed to load articles. Please try again.