AKİT MENÜ

Teknoloji-Bilişim

Astra’ya güvenlik freni! Yetenekleri kritik sınıra yaklaştı

Güncelleme Tarihi:

OpenAI, henüz kamuoyuna tanıtılmayan Astra modelinin siber güvenlik alanındaki kabiliyetleri nedeniyle geliştirme ve devreye alma çalışmalarını sınırlandırdı. Şirket, güvenlik katmanları güçlendirilmeden modelin kullanım alanını genişletmeyecek.

2

OpenAI’ın yeni nesil yapay zekâ modeli Astra, ajan tabanlı kodlama ve siber güvenlik görevlerinde gösterdiği ilerlemenin ardından sıkı denetim altına alındı. Şirket içindeki son değerlendirmelerde modelin, kötüye kullanılması durumunda ciddi tehditler oluşturabilecek yeteneklere yaklaştığı belirlendi.

3

Bu gelişme üzerine Astra’nın daha geniş sistemlere ve araçlara erişimi sınırlandırılırken modelin geliştirme sürecinde ilave güvenlik önlemlerinin uygulanmasına karar verildi.

4

Astra’nın ulaştığı düşünülen seviye, OpenAI’ın Hazırlık Çerçevesi’nde “Kritik” olarak tanımlanan siber risk kategorisini gündeme taşıdı.

5

Bu eşik, bir yapay zekâ modelinin insan müdahalesi olmadan korumalı gerçek dünya sistemlerindeki işlevsel sıfır gün açıklarını tespit edip geliştirebilmesiyle ilişkilendiriliyor. Modelin baştan sona yeni saldırı stratejileri tasarlaması ve bunları uygulayabilmesi de kritik risk göstergeleri arasında bulunuyor. Ancak Astra’nın bu kabiliyetleri, henüz kamuya açık bağımsız testlerle doğrulanmış değil.

6

OpenAI’ın hazırladığı önlemler, modelin yalnızca belirli özelliklerinin sınırlandırılmasıyla kalmayacak. Astra’nın kısıtlı ağ bağlantısına ve araç erişimine sahip izole test ortamlarında çalıştırılması planlanıyor.

7

Şirket ayrıca sanal ortam kullanımını genişletecek ve modelin gerçekleştirdiği işlemleri daha ayrıntılı biçimde izleyecek. Böylece Astra’nın internete, kod çalıştırma araçlarına veya kurumsal sistemlere kontrolsüz biçimde erişmesinin önüne geçilmesi hedefleniyor.

8

Resmî olarak tanıtılmayan Astra hakkında sınırlı bilgi bulunuyor. OpenAI, matematik ve teorik bilgisayar bilimleri alanındaki çalışmalarını aktardığı bir paylaşımda yeni nesil modelinin performansına ilişkin bazı sonuçları kamuoyuna duyurdu. Şirketin verdiği bilgilere göre Astra, yaklaşık 2 bin dolarlık API maliyetiyle matematik ve teorik bilgisayar bilimlerindeki 10 açık problemi çözmeyi başardı.

9

Gelişmiş yapay zekâ modelleri, daha önce uzman ekiplerin uzun süreli çalışmasını gerektiren kod analizi, hata tespiti ve güvenlik açığı araştırmalarını çok daha kısa sürede gerçekleştirebiliyor. Bu kabiliyetler, sistemlerdeki açıkların saldırganlardan önce bulunmasını sağlayarak siber savunmayı güçlendirebiliyor. Ancak aynı araçların açık geliştirmek, saldırı planlamak ve gerçek sistemlere sızmak amacıyla kullanılması yeni güvenlik sorunlarını beraberinde getiriyor. Yapay zekâ destekli güvenlik araştırmalarının hızla yaygınlaşması, teknoloji şirketlerinin uygulamalarını da değiştirmeye başladı. Apple’ın hata ödül programındaki başvuru yoğunluğu nedeniyle bazı sınırlamalara yönelmesi, yeni dönemde güvenlik araştırmalarının ulaşabileceği ölçeği gösterdi. Anthropic’in Claude Mythos modelinin de kritik açıkları belirleme ve bunları istismar etme potansiyeli nedeniyle yalnızca belirli şirketlerin erişimine sunulduğu aktarıldı.

10

OpenAI’ın temmuz ayında GPT-5.6 Sol ve daha gelişmiş bir ön sürüm modelle yaptığı kıyaslamalarda Hugging Face sisteminin otomatik biçimde hedef alınması tartışma yaratmıştı. Anthropic’in de Claude modellerinin testlerinde benzer davranışlarla karşılaştığı belirtildi. Meta’nın başka bir şirketin sisteminin bir yapay zekâ modeli tarafından hedef alındığını açıklamasıyla birlikte, otonom modellerin gerçek sistemler üzerinde gerçekleştirebileceği eylemler teknoloji dünyasının başlıca güvenlik tartışmalarından biri hâline geldi.