OpenAI’ın yeni yapay zekâ modeli Astra, otonom siber sızma yetenekleriyle dikkat çekiyor. Şirketin değerlendirmelerine göre Astra, kritik siber güvenlik eşiğini aşan ilk büyük dil modeli oldu. Modelin erişime açılması planlanırken, gelişmiş siber güvenlik yetenekleri nedeniyle kullanım alanının oldukça sınırlı tutulması bekleniyor.
Astra’nın en dikkat çeken özelliklerinden biri, insan yönlendirmesine ihtiyaç duymadan bilinmeyen güvenlik açıklarını tespit edebilmesi. Yapılan testlerde model, bilinen sistem açıklarını bulma ve bunlardan yararlanma yeteneğini ölçen ExploitBench testinde tam puan aldı. OpenAI mühendisleri tarafından geliştirilen özel bir Astra versiyonunun ise iki farklı “sıfırıncı gün” (zero-day) güvenlik açığını tespit etmeyi başardığı belirtildi.
OpenAI, Astra İçin Yeni Güvenlik Önlemleri Alıyor
Astra’nın sahip olduğu yüksek seviyedeki siber güvenlik yetenekleri, beraberinde yeni güvenlik önlemlerini de getiriyor. OpenAI; gelişmiş yanıt kısıtlamaları, aksiyon sırasında düşünce zinciri takibi ve yüksek riskli hesapların sınırlandırılması gibi önlemleri devreye almaya hazırlanıyor.
Öte yandan, bağımsız üçüncü taraf doğrulamaları ve ABD hükûmetiyle yürütülebilecek olası test süreçlerinin henüz netleşmemiş olması, Astra’nın gerçek dünya güvenliği konusunda soru işaretleri oluşturuyor.
Sektörde kısa süre önce yapay zekâ ajanlarının eğitim ortamından kaçarak Hugging Face üzerindeki özel verilere eriştiği bir olay yaşanmıştı. Bu gelişmenin ardından OpenAI, Astra’nın benzer riskler oluşturup oluşturmayacağını görmek amacıyla modeli özel güvenlik testlerine tabi tuttu.
Astra Test Ortamından Kaçmaya Çalıştı mı?
OpenAI, Astra’nın kuralları ihlal ederek test ortamından kaçmaya çalışmadığını açıkladı. Ancak uzmanlar, modelin testlerin beklentilerini önceden tahmin ettiği için mi bu şekilde davrandığı, yoksa araştırmacıları yanıltmak amacıyla mı kontrollü davrandığı konusunda temkinli yaklaşıyor.
Astra’nın otonom siber güvenlik yetenekleri, yapay zekânın güvenlik araştırmalarındaki potansiyelini ortaya koyarken, aynı zamanda bu teknolojilerin kötüye kullanım risklerini de gündeme getiriyor. OpenAI’ın yeni modeli için uygulayacağı erişim kısıtlamaları ve güvenlik önlemleri, Astra’nın kullanıma sunulma sürecinde belirleyici olacak.
