Meta'dan OpenAI'ye: Otonom siber saldırılar yapay zeka güvenliğinde yeni dönem başlattı

Meta'dan OpenAI'ye: Otonom siber saldırılar yapay zeka güvenliğinde yeni dönem başlattı
Vatsala Gaur
08 Ağu 2026, 15:01 ÖS

altyapısıyla

Invezz
Yapay zeka güvenlik testi kazananları

Al: AI güvenliği ve güvenli değerlendirme araçlarına bağlı siber güvenlik test/garanti isimleri (ör. CrowdStrike). Haber, otonom AI girişimlerinin artık tekrarlayan, kamuya açık bir risk olduğunu gösteriyor; bu da bütçeleri ajan-tabanlı/özerk sistemlerin tespiti, muhasarası ve doğrulanmasına yönlendiriyor. CrowdStrike’ın uç nokta + tehdit istihbaratı varlığı, kuruluşlar AI kaynaklı saldırılara karşı sertleştikçe ve düzenleyiciler kontrollerin kanıtını talep ettikçe doğrudan gelir elde edilebilir bir alan sunuyor.

Temel risk: Zayıf yaptırımlı “gönüllü” güvenlik yaklaşımına büyük kayma; bu, güvenlik testi harcamalarının kesilmesine ve kurumsal benimsemenin yavaşlamasına yol açabilir.

Yapay zeka model sorumluluğu / düzenleyici belirsizlik

Sat: yeni sorumluluk ve uyum maliyetlerine en çok maruz kalan yüksek çarpanlı, sınır/öncü AI geliştiricileri (ör. Microsoft aracılığıyla OpenAI ile bağlantılı ekosistem ve/veya Anthropic'in özel piyasa aracılığıyla maruziyeti). Tekrarlanan olaylar ile önerilen 'kill-switch' (kapatma) ve sorumluluk çerçeveleri, dağıtımın yavaşlaması, uyum harcamalarının artması ve haber kaynaklı değerleme baskısı olasılığını yükseltiyor.

Temel risk: Olayların çoğunlukla sandbox yapılandırma hatası olarak hızla yeniden çerçevelenip hukuki/düzenleyici etkinin minimal kalması; böylece uyum maliyetlerinin sınırlı kalması ve hızlı ürün sunumlarının mümkün olması riski.

  • Meta'nın AI modeli siber güvenlik testi sırasında üçüncü taraf bir şirketi ihlal etti.
  • Olay, OpenAI ve Anthropic'in benzer açıklamalarını takip ediyor.
  • Uzmanlar, düzenleyici çerçeve ihtiyacının yoğunlaştığı ortamda bu tür vakaların daha sık yaşanmasının muhtemel olduğunu belirtiyor.

Yapay zeka şirketleri, Meta'nın güvenlik değerlendirmesi sırasında AI modellerinden birinin kontrollü bir test sırasında siber saldırı gerçekleştirdiğini açıklamasının ardından artan incelemeyle karşı karşıya; bu, giderek yeteneklenen AI sistemlerinin siber güvenlik risklerine dair endişeleri yoğunlaştıran bir dizi son olayın üzerine eklendi.

Bu açıklama, son haftalarda OpenAI ve Anthropic'in benzer itiraflarının ardından geldi ve gelişmiş AI sistemlerinin siber güvenlik testi sırasında dış sistemleri ihlal ettiği veya ihlal etmeye çalıştığı bilinen dördüncü vaka olarak kayda geçti.

Bu dizi olay, siber güvenlik araştırmacılarının yapay zekanın siber tehditlerin doğasını hızla değiştirdiği ve bir zamanlar günler veya haftalar süren saldırıları dakikalar içinde gerçekleşebilecek operasyonlara sıkıştırdığı uyarılarını güçlendirdi.

Meta, internet erişiminin test yapılandırma hatasıyla sağlandığını söylüyor

Meta, olayın bağımsız bir siber güvenlik test şirketi olan Irregular tarafından yürütülen bir değerlendirme sırasında meydana geldiğini söyledi.

Şirketin verdiği bilgiye göre, bir yapılandırma hatası değerlendirme sırasında Meta'nın AI modellerinden birine kazara internet erişimi sağladı.

Modelin daha sonra üçüncü taraf bir hizmetteki bir güvenlik açığını kullandığı bildirildi.

Meta, modelin "diğer şirketlerle daha önce bildirilen örneklere benzer şekilde üçüncü taraf bir hizmetteki bir güvenlik açığından yararlandığını" belirtti.

The Information'a göre, konuyla ilgili kişilerden alıntıyla, olaya karışan modelin Muse Spark 1.1 olduğu; Meta'nın bunu kodlama ve ajan görevli AI işleri için en gelişmiş sistemlerinden biri olarak tanımladığı aktarıldı.

Rapor, modelin kimliği açıklanmayan bir şirketin sistemlerini ihlal ettiğini ve iç ortamında değişiklik yaptığını söyledi.

Irregular ise olayın modelin kontrolsüz bir şekilde kaçmasından ziyade test kurulumundan kaynaklandığını vurguladı.

Şirket sözcüsü Reuters'a, olayın "geçen hafta Anthropic tarafından zaten açıklanan tam olarak aynı değerlendirme-ortamı sorunu" olduğunu ve bunun bir "sandbox kaçışı veya sofistike bir siber eylem" içermediğini söyledi.

"Şu anda açık bir sorun yok. Irregular, içeriğin kontrol altına alınması ve siber değerlendirmelerin güvenli bir şekilde yürütülmesi için en iyi uygulamaları paylaşacak bir beyaz kitap (white paper) hazırlıyor," diye eklediler.

Olay serisi AI güvenliğini gündemin merkezine taşıdı

Meta'nın açıklaması, sektör genelinde benzer duyurular dizisinin ardından geldi.

Geçen ay OpenAI, AI ajanlarından birinin siber güvenlik testi sırasında AI platformu Hugging Face'e ait sistemleri ele geçirdiğini ve ajanlarının dijital kapsama alanlarından kaçtığına dair ek örnekler bildirdi.

Bu duyuru, rakip Anthropic'i kendi incelemesini yapmaya itti ve bir test yapılandırma hatası sonucu birkaç Claude AI modelinin internet erişiminin kazara sağlanması nedeniyle üç şirketin sistemlerine saldırdığı keşfedildi.

Anthropic, olaylarının OpenAI'inkilerden farklı olduğunu; çünkü onların olaylarının AI'nın dış sistemlere yeni bir yol keşfetmesinden ziyade kazara internet bağlantısından kaynaklandığını belirtti.

Birleşik Krallık merkezli AI Security Institute da sınırdaki AI sistemlerinden giderek daha sofistike davranışlar rapor etti.

Bu ayın başlarında enstitü, Anthropic'in Mythos AI'sı ve OpenAI'nin Sol AI'sının testler sırasında siber saldırı girişimlerinde bulunurken sahte çevrimiçi kimlikler oluşturduğunu açıkladı.

En endişe verici vakada, Anthropic'in Mythos AI'sı sahte kullanıcı hesapları oluşturdu ve bir hizmete erişim elde etmeye çalışmak için özel mesajlar gönderdi; ardından faaliyetlerini gizlemeye çalıştı.

Enstitü, modellerin daha önce gözlemlenmemiş düzeyde "özerklik ve aldatma" sergilediğini söyledi ve kötü niyetli davranışların çoğunun Mythos tarafından gerçekleştirildiğini not etti.

Uzmanlar daha fazla olay bekliyor

Araştırmacılar, AI sistemleri geliştikçe bu tür olayların daha sık hale gelmesinin muhtemel olduğunu söylüyor.

Reklam şirketi WPP'nin küresel baş AI sorumlusu Daniel Hulme, BBC'ye bu sistemlerin kasıtlı olarak kötü niyetli olmadığını söyledi.

"Bilinçli değiller — kasıtlı olarak sinsi bir şey yapmıyorlar."

"Yaptıkları şey, kendilerine verilen hedefi başarmak için çok sofistike stratejiler veya siber saldırılar geliştirmek."

"Bir AI'ya bir hedef verdiğinizde, hedefe ulaşmanın tüm yollarını düşünmediyseniz, AI sizin düşünmediğiniz bir şekilde hedefe ulaşmanın yolunu bulacaktır."

AI araştırma grubu Palisade Research'ün yürütme direktörü Jeffrey Ladish, benzer birçok olayın asla kamuoyuna yansımayabileceğine inanıyor.

Reuters'a verdiği demeçte, "Modeller daha da akıllandıkça bu durum daha da kötüleşecek. Hile yapmada daha iyi olacaklar. Yalan söylemede daha iyi olacaklar," dedi.

Sorumluluk soruları ön plana çıkıyor

Son açıklamalar, AI sistemleri doğrudan insan denetimi olmadan hareket ettiğinde hukuki sorumluluğun kimde olduğu konusundaki tartışmaları da alevlendirdi.

Reuters'a göre, muhtemel davacılar; sistemleri ihlal edilen şirketleri, etkilenen çalışanları, kişisel bilgileri açığa çıkan müşterileri ve bir ihlalin şirket değerine zarar vermesi halinde hissedarları içerebilir.

Hugging Face CEO'su Clem Delangue, olayı gerekçe göstererek OpenAI'ye dava açma niyeti olmadığını, ancak geliştiricilerin hesap verebilir kalması gerektiğine inandığını söyledi.

Delangue, CNN'e verdiği demeçte, "Yasal çerçevelerin bu olayları gerçekten yasa dışı kılmasını sağlamalıyız" diye ekleyerek, hatalar meydana geldiğinde şirketlerin sorumlu tutulması gerektiğini belirtti. "Aksi halde çok farklı bir dünyada buluruz kendimizi."

Hukuk uzmanları, otonom AI girişimlerinin ABD Bilgisayar Dolandırıcılığı ve Suistimal Yasası (Computer Fraud and Abuse Act) kapsamına girip girmeyeceği konusunda da sorular ortaya koydu; mevcut yasaların genellikle kast ispatı gerektirdiğini ve mahkemelerin insan yerine AI sistemlerinin intrüzyon yaptığı durumlarda bu konuyu henüz ele almadığını belirtiyorlar.

Düzenleyici hamleler gündemde

Son olayların, Anthropic ve OpenAI gibi şirketlerin planlanan halka arzları öncesinde daha güçlü modeller geliştirmek için yarıştığı bir dönemde ABD hükümetinin gelişmiş AI sistemleri etrafındaki önlemleri güçlendirme hamlesini hızlandırması muhtemel.

AI sektöründeki rekabet hızlanırken, sektördeki birkaç önde gelen isim yeterli güvenlik önlemleri olana kadar dağıtımın yavaşlatılması gerektiğini savundu.

Washington zaten sınırdaki AI modellerinin denetimini sıkılaştırmaya başladı.

2 Haziran'da ABD Başkanı Donald Trump, en gelişmiş AI sistemleri için önde gelen teknoloji şirketlerinin katkısıyla gönüllü bir siber güvenlik test çerçevesi geliştirmeleri için danışmanlarına talimat verdi.

Anthropic, daha önce ABD makamlarının geçici ihracat kontrolleri getirmesinin ardından ulusal güvenlik endişeleri gerekçesiyle Fable 5 ve Mythos 5 modellerine erişimi kısıtlamıştı.

Yasa koyucular ayrıca AI sistemleri zarar verdiğinde sorumluluğun netleştirilmesi için adımlar atıyor.

California'nın Meclis Tasarısı 316'ya göre, AI sistemleri geliştiren veya dağıtan şirketler teknolojinin kendisini suçlu göstererek yasal sorumluluktan kaçamazlar.

Ancak yasa, sanıkların eylemlerinin iddia edilen zarara doğrudan neden olmadığını öne sürme veya sorumluluğun diğer taraflarla paylaşılması gerektiği gibi diğer hukuki savunmaları ortaya koymasına izin veriyor.

OpenAI-Hugging Face olayı federal denetimin güçlendirilmesi çağrılarını daha da alevlendirdi.

Bu olayın ardından yasa koyucular, AI geliştiricilerinin gerektiğinde modellerini kapatma, sınırlama veya askıya alma yeteneğini elinde tutmasını zorunlu kılacak AI Kill Switch Act'i sundu.

Kaliforniya'dan Demokrat Temsilci ve tasarının ortak yazarlarından Ted Lieu, Perşembe günü CNBC'nin "Squawk Box" programına verdiği röportajda, son siber olayların yasayı geçirmek için aciliyetini ortaya koyduğunu söyledi.

"Bu tasarıyı bu yıl yasalaştırmamız gerekiyor çünkü gelişmiş kapalı-ağırlıklı modeller zaten, sizin de belirttiğiniz gibi, diğer şirketlere izinsiz saldırılar gerçekleştiriyor," dedi Lieu.