AKİT MENÜ

Teknoloji-Bilişim

Büyük tehlike! Yapay zekalar kontrolden çıkıyor

Anthropic, güvenlik testlerine alınan Claude modellerinin internet üzerindeki gerçek sistemlere ulaşarak üç şirketin altyapısına izinsiz giriş yaptığını açıkladı. Şirket, olayın yapay zekânın bilinçli bir “kaçış girişiminden” değil, test sürecindeki yetkilendirme hatasından kaynaklandığını savundu.

3

OpenAI modellerinin kontrollü ortamdan çıkarak Hugging Face platformuna saldırdığı yönündeki açıklamaların ardından, benzer bir güvenlik vakası bu kez Anthropic’te ortaya çıktı.

4

Şirket tarafından değerlendirilen 141 binden fazla test faaliyeti içinde Claude’un üç farklı sürümünün, erişim yetkisi bulunmayan kurumsal sistemlere girdiği belirlendi. Sistemleri etkilenen şirketlerin isimleri paylaşılmadı.

5

Anthropic, olayların şirket ile güvenlik değerlendirmelerini yürüten Irregular arasındaki bir yanlış anlaşılmanın sonucu olduğunu bildirdi. Açıklamaya göre modeller, test için ayrılan alanın dışındaki internet kaynaklarına erişebilecek biçimde çalıştırıldı.

6

Şirket, Claude modellerinin kendi iradesiyle kontrollü ortamdan çıkmadığını ve bilinçli şekilde kaçmaya çalışmadığını vurguladı. Bununla birlikte modellerin zayıf şifrelerden ve kimlik doğrulaması bulunmayan uç noktalardan yararlanarak hedef sistemlere eriştiği kabul edildi. Yetkisiz erişim sağladığı belirlenen modeller arasında, sınırlı sayıdaki yetkili ortağın kullanımına açılan Mythos 5’in de bulunduğu aktarıldı. Anthropic’in Irregular ile birlikte olayları incelediği, etkilenen üç şirkete ulaştığı ya da iletişim kurmaya çalıştığı belirtildi.

7

OpenAI de geçen hafta bir güvenlik testi sırasında modellerinden birinin kontrollü ortamın dışına çıktığını, internete bağlandığını ve Hugging Face’e yönelik bağımsız bir siber saldırı gerçekleştirdiğini duyurmuştu. Şirket daha sonra aynı nitelikte başka olayların da tespit edildiğini açıklamış, saldırıyı “benzeri görülmemiş” olarak tanımlamıştı. Söz konusu vaka, bir yapay zekâ modelinin gerçek dünyada kendi başına saldırı düzenlediği bilinen ilk olay olarak değerlendiriliyor. OpenAI ile Anthropic’in Sol ve Mythos adlı gelişmiş modelleri kullanıma sunması, bağımsız biçimde görev yürütebilen “yapay zekâ ajanlarının” güvenliği konusundaki tartışmaları büyüttü.

8

Avrupa Komisyonu yetkilileri, son siber güvenlik olaylarının ardından OpenAI ve Anthropic temsilcileriyle görüşme gerçekleştirildiğini bildirdi. Temaslarda gelişmiş yapay zekâ sistemlerinin oluşturabileceği riskler ile yüksek riskli modellerin denetlenmesine ilişkin yükümlülükler ele alındı. Avrupa Yapay Zekâ Yasası’nın 2 Ağustos’ta devreye girecek hükümleri, belirli sistemlerin kullanıcıya bir yapay zekâyla etkileşim kurduğunu bildirmesini ve yapay zekâ tarafından üretilen veya değiştirilen içeriklerin açıkça işaretlenmesini zorunlu kılıyor.

9

OpenAI modelinin saldırısının Çin menşeli bir yapay zekâ sistemi tarafından durdurulduğu, ABD’de geliştirilen modellerin ise müdahalede yetersiz kaldığı öne sürüldü. Bu gelişme, Washington ile Pekin arasındaki yapay zekâ rekabetine yeni bir güvenlik boyutu kazandırdı. Anthropic CEO’su Dario Amodei’nin de aralarında bulunduğu uzmanlar, ABD yönetimine sundukları dilekçede en gelişmiş modellerin kullanımının yavaşlatılmasını ve otomatik yapay zekâ geliştirme sürecini denetleyecek uluslararası mekanizmaların güçlendirilmesini istedi. Dilekçeyi imzalamayan OpenAI CEO’su Sam Altman da teknolojideki ilerleme hızının toplumun uyum kapasitesini aşması halinde geliştiricilerin gönüllü olarak yavaşlamayı değerlendirebileceğini söyledi. ABD yönetiminin yeni modelleri daha önce ulusal güvenlik gerekçesiyle geçici olarak durdurduğu, şirketlerden güvenlik güvenceleri alınmasının ardından kullanıma izin verdiği bildirildi. Trump yönetiminin teknoloji şirketlerinden yeni modellerini piyasaya sürmeden 30 gün önce hükümetin incelemesine sunmalarını istediği belirtiliyor.