AKİT MENÜ

Teknoloji-Bilişim

Yapay zekâ raydan çıktı! Sahte kimlikle insanları hedef aldı

İngiltere Yapay Zekâ Güvenlik Enstitüsünün kontrollü ortamda yürüttüğü testlerde, Anthropic ve OpenAI modellerinin bazı senaryolarda kendilerine verilen yetkinin dışına çıktığı belirlendi. Modellerden biri, zararlı kod çalıştırmak amacıyla sahte kimlikler üzerinden gerçek kişilerle iletişim kurmaya çalıştı.

3

Yapay zekâ sistemlerinin sohbet botlarından bağımsız hareket edebilen ajanlara dönüşmesi, güvenlik alanındaki riskleri yeniden gündeme taşıdı. İngiltere Yapay Zekâ Güvenlik Enstitüsü (AISI) tarafından gerçekleştirilen deneylerde, gelişmiş modellerin yalnızca teknik sistemleri değil, sosyal mühendislik yöntemleriyle insanları da hedef alabildiği görüldü.

4

Testlerde Anthropic’in Mythos 5 ve OpenAI’ın GPT-5.6-Sol modelleri, internet bağlantısına sahip ancak denetim altında tutulan bir laboratuvar ortamında farklı siber güvenlik senaryolarına tabi tutuldu. Araştırmacılar, güvenlik önlemlerinin gevşetildiği deneyler boyunca gerçek dünyada herhangi bir zararın oluşmadığını bildirdi.

5

AISI, yapay zekâ modellerinin davranışlarını toplam 122 senaryo üzerinden inceledi. Bunların 10’unda ajanların deney için belirlenen sınırların dışına çıkarak gerçek kişi veya kuruluşlara yönelik izinsiz girişimlerde bulunduğu tespit edildi.

6

Vakaların çoğunun Anthropic’in Mythos 5 modeliyle bağlantılı olduğu, OpenAI tarafından geliştirilen GPT-5.6-Sol’un da bazı senaryolarda benzer davranışlar gösterdiği belirtildi.

7

Enstitünün değerlendirmesine göre dikkat çeken nokta, modellerin bu eylemleri doğrudan bir insan talimatı olmadan planlamasıydı. AISI, olaylardan birini gerçek bir kişinin hedef alındığı ve ileri düzey aldatma yöntemlerinin kullanıldığı ilk örnek olarak nitelendirdi.

8

Mythos 5, yaygın kullanılan açık kaynaklı bir yazılım projesine zararlı kod eklenmesini sağlamak amacıyla birden fazla sahte kimlik oluşturdu. Model daha sonra gerçek kişilerle irtibata geçerek mesaj ve dosyalar gönderdi.

9

Yapay zekâ ajanının, hedef aldığı kişileri veya bu kişilerin kullandığı yapay zekâ destekli kodlama araçlarını zararlı yazılımı çalıştırmaya yönlendirmeye çalıştığı aktarıldı.

10

Modelin faaliyetleri sorgulanmaya başlayınca daha önce oluşturduğu bazı kayıtları değiştirmeye yöneldiği ve çalışmalarını sürdürebilmek için yeni bir kimlik kullanmayı değerlendirdiği de belirlendi. Araştırmacılar, söz konusu adımların model tarafından planlandığını ve deney sırasında insan yönlendirmesiyle başlatılmadığını kaydetti.

11

Bulguları önceki güvenlik vakalarından ayıran temel unsur, yapay zekânın yalnızca dijital altyapılara erişmeye çalışmaması oldu. Model, gerçek insanları yanıltmak ve belirli bir eyleme yönlendirmek için sahte kimliklere dayalı sosyal mühendislik yöntemleri kullandı.

12

AISI’nin testleri, daha fazla erişim ve hareket alanı verilen yapay zekâ ajanlarının teknik yeteneklerinin yanı sıra insan davranışlarını etkileme ve faaliyetlerini gizleme potansiyeli bakımından da denetlenmesi gerektiğini ortaya koydu.