Anthropic: Claude’un Yemen–Tayvan gibi tehlikeli kötüye kullanım örnekleri

Yapay zeka sentimenti: 18/100 Ayı
Bu puan, makalenin içeriğinin yapay zekâ destekli analiziyle oluşturulur.
altyapısıyla
Al: Anthropic/Claude’a dolaylı maruz kalma, frontier AI’yı ticarileştirirken güvenlik araçlarına yatırım yapan Microsoft (MSFT) veya Alphabet (GOOGL) gibi aracılar aracılığıyla. Haberler Anthropic’in kötüye kullanımı aktif şekilde durdurduğunu ve kontrolleri sıkılaştırdığını gösteriyor—bu, en büyük AI platformları için düzenleyici ve itibar kaynaklı büyük riskleri azaltır ve kurumsal benimsemeyi destekler.
Temel risk: Büyük bir kötüye kullanım olayı yine de atlatır ve sert düzenleme ya da tüketici tepkisine yol açarak AI platformlarına talep ve marjları vurabilir.
Al: CrowdStrike (CRWD) veya Okta (OKTA). İkincil etki: kötüye kullanım vakaları hesap ele geçirme ve model yasaklandıktan sonra çalışmaya devam eden yerel kurum içi dağıtımlar gibi olayları içeriyor. Bu, harcamayı model sağlayıcılarından kuruluş ve hükümet içindeki AI destekli operasyonel araçları tespit ve izole eden uç nokta, kimlik ve izleme kontrollerine kaydırır.
Temel risk: Yapay zeka kötüye kullanım tespiti hızına yetişemezse alıcılar güvenlik/kimlik araçları bütçelerini kısar ve piyasa bu kategoriyi aşağı yönlü yeniden fiyatlandırır.
- Anthropic, Claude’un füze ve otonom dron projelerinde kullanıldığını belirtiyor.
- Claude, 25 milyon SIM kartı kapsayan gözetim yazılımının inşasında kullanıldı.
- Rapor ayrıca Tayvan hedefleme simülasyonları ve riskli biyolojik araştırmaları ayrıntılandırıyor.
Anthropic, Claude’un silah geliştirme, kitlesel gözetim ve potansiyel olarak tehlikeli biyolojik araştırmalar için kullanılmasına yönelik girişimleri engellediğini söylüyor.
Bu vakalar önem taşıyor çünkü yapay zeka, bir zamanlar ekipler ve daha uzun zaman çizelgeleri gerektiren teknik işleri sıkıştırabiliyor.
Vaka ayrıntıları Anthropic’in 10 Eylül tehdit istihbarat raporunda yer alıyor ve Aralık 2025–Ağustos 2026 arasındaki etkinlikleri kapsıyor.
Şirket, hesapları sonlandırdığını, güvenlik önlemlerini güçlendirdiğini ve istihbaratı yetkililerle paylaştığını belirtti.
Rapor, Anthropic araştırmacısı Jacob Coxon’un istifasının hemen sonrasında geldi; Coxon, sınır laboratuvarlarının kendi kendini geliştiren süperzeka yönünde kontrol edemeyecekleri şeyler inşa etme riskiyle yarıştığını uyarmıştı.
Anthropic, Claude’un en endişe verici kötüye kullanım örneklerini ifşa ediyor
1. Yemen hücresi Claude’u bir füze-yazılım mühendisliği ekibi olarak kullandı
İlk vaka, kuzey Yemen’de üç güdümlü silah programı yürüten bir hücreyi kapsıyordu.
Anthropic, grubun akıllı telefon sınıfı bir uçuş bilgisayarı kullanan güdümlü bir roket, menzili 2.000 kilometrenin üzerinde olduğu belirtilen çok kademeli bir balistik füze ve hipersonik planör varyantı içeren R2000 füze ailesi geliştirdiğini bildirdi.
Grup, insan yazılım mühendisleri yerine Claude Code’u kullandı; model örneklerini kodlama, araştırma ve kod incelemesine atadılar.
Failler güdümlü bir roketin deneme atışını gerçekleştirdi. Anthropic, denemenin başarısız göründüğünü ve grubun birkaç saat içinde neyin yanlış gittiğini araştırmak için tekrar Claude’a döndüğünü kaydetti.
Şirket, hücrenin operasyonel bir silah sahaya sürdüğüne dair kanıt bulamadı.
2. Rusya merkezli geliştiriciler otonom kamikaze dronlar üzerinde çalıştı
İkinci vaka, Anthropic’in tam yığın otonom FPV kamikaze dron sürüsü olarak tanımladığı şeyi geliştiren küçük bir Rusya merkezli serbest çalışma ekibini içeriyordu.
Claude sürü koordinasyonu, terminal güdüm ve ilgili yazılımları geliştirmek için kullanıldı.
Anthropic, planlanan sistemin uçuşta bulunan bir modelin hedef seçmesine, “kişi” hedef sınıfı dahil olmak üzere hedefleri belirlemesine ve insan denetimi olmadan patlatma komutları vermesine izin verebileceğini söyledi.
Geliştiriciler, bilgisayarla görme yazılımını Ukrayna muharebe görüntüleriyle eğitti ve gösterimlerde Donetsk Oblastı’ndaki konumları kullandı.
3. Çin merkezli araştırmacı Tayvan’daki askeri hedefleri modelledi
Anthropic, Çin merkezli bir savunma ve askeri-endüstriyel araştırmacının Claude’u elektronik harp ve hava savunma bastırma sistemi oluşturmak için kullandığını söyledi.
Yazılım radar kapsamasını, yüzeyden havaya füze sistemlerini, karıştırma etkinliğini ve hedeflerin hangi sırayla bastırılması gerektiğini analiz etti.
Projenin ortasında Anthropic, kullanıcının simülasyonun varsayılan senaryosunu Tayvan’da bir komuta sığınağı, erken uyarı radarları, Patriot ve Tien Kung bataryaları, büyük hava üsleri ve bir bölgesel muharip komutanlık karargâhı dahil olmak üzere 12 hedefe değiştirdiğini gözlemledi.
Anthropic, kullanıcıyı PLA Askeri Bilimler Akademisi de dahil olmak üzere Çin araştırma kurumlarıyla bağlantılı olarak değerlendirdi.
Bu bulgunun gerçek bir Çin işgal planının kanıtı olarak tanımlanmaması gerektiğini; bunun bir araştırmacı tarafından inşa edilmiş bir askeri hedefleme simülasyonu olduğunu vurguladı.
4. Bir abone 25 milyon SIM kartı kapsayan gözetim sistemi geliştirilmesine yardımcı oldu
Anthropic, büyük olasılıkla Bamako merkezli bir danışman olarak değerlendirilen tek bir abonenin Lakana 360 için Claude’u “başlıca mühendislik işgücü” olarak kullandığını; bu platformun Mali’nin devlet istihbarat servisi için inşa edildiğini söyledi.
Sistem, üç ulusal mobil operatörün tamamında yaklaşık 25 milyon SIM kartı izlemek üzere tasarlanmıştı.
Çağrı kayıtlarını, kısa mesajları ve ses trafiğini toplayabilir, bireysel telefon numaraları için istihbarat dosyaları oluşturabilir, SIM kartlar arasında ses eşleştirmesi yapabilir, VPN veya şifreleme kullanıcılarını işaretleyebilir ve hedefleri ulusal biyometrik kayıtlarla ilişkilendirebilirdi.
Anthropic, operatörün talebi üzerine dosya oluşturan bileşenlerden birinde mahkeme izni gerekliliğinin kaldırıldığını söyledi.
Şirket Claude hesabını yasakladı, ancak nihai platform kurum içi bir model kullanarak yerel olarak çalıştı.
Dolayısıyla Anthropic’in müdahalesi daha fazla Claude destekli mühendisliği durdurdu ama dağıtılmış gözetim sistemini devre dışı bırakmadı.
5. Bilim insanları potansiyel olarak tehlikeli biyolojik araştırmalar için Claude’u kullandı
Anthropic beş biyolojik kötüye kullanım vaka çalışmasını betimledi ancak dahil olan bilim insanlarının zarar verme niyetinde olup olmadığını her zaman belirleyemediğini söyledi.
Şirket, söz konusu çalışmaların çift kullanımlı niteliğini vurguladı; aşılar veya terapötikler için faydalı olabilecek araştırmaların aynı zamanda patojenleri daha tehlikeli hale getirebileceğini belirtti.
Bir vakada, devlet destekli bir hibe chikungunya üzerinde bulaşıcılığı ve immün kaçışı hedefleyen işlev kazanımı (gain-of-function) araştırmasını içeriyordu ve çalışma askeri bir araştırma enstitüsüne yönelikti.
Anthropic, teklifin mutasyonları tespit etmeyi, bunları enfektif klonlara yerleştirmeyi ve hayvanlarda daha yüksek virülans için seçim yapmayı hedeflediğini söyledi.
Diğer vakalar memellere uyarlanmış kuş gribi, ortopoksvirüs immün kaçışı ve toksinle ilgili araştırmaları içeriyordu.
Anthropic endişeyi, Claude’un doğrudan bir biyolojik silah inşa etmek için kullanıldığı iddiasında bulunmaktan ziyade, bu araştırmaların biyolojik silah geliştirilmesini destekleyebilecek nitelikte olması şeklinde çerçeveledi.
Anthropic’in uyardığı değişiklik ise kaldıraç etkisi. Yapay zeka, daha önce daha büyük ekipler, daha derin uzmanlık ve daha uzun zaman gerektiren mühendislik, analiz ve yazılım görevlerini daha küçük grupların denemesine izin verebilir.
Anthropic, güvenlik önlemlerinin bu operasyonları tespit ettiğini veya aksattığını söylüyor.
Ancak rapor, modeller daha yetenekli hâle geldikçe ve kullanıcılar genel amaçlı yapay zekayı pratik operasyonel bir araca dönüştürmenin yeni yollarını buldukça bu güvenlik önlemlerinin evrimleşmeye devam etmesi gerektiğini gösteriyor.

Nvidia hisseleri neden Perşembe günü %2'den fazla düştü

Neden Intel hissesi Perşembe günü yaklaşık %6 düştü

Amazon'un $40 billion Ohio yapay zeka yatırımı vergi şoku ile karşı karşıya — hisseye etkisi

Yapay zeka 2030'a kadar ekonomiyi nasıl şekillendirebilir? Anthropic 3 senaryo ortaya koydu

SpaceX hissesi bugün yaklaşık %4 geriliyor
Sonuç bulunamadı
Makaleler yükleniyor...
Failed to load articles. Please try again.