OpenAI, kritik siber güvenlik riski tespit etti ve kontrolleri sıkılaştırdı
OpenAI cuma günü yaptığı açıklamada, geliştirilmekte olan Astra adlı yeni yapay zekâ modelinin “kritik” düzeyde siber güvenlik yeteneklerine sahip olma ihtimalini göz ardı edemediğini belirtti.
Bunun üzerine şirket bazı dahili geliştirme çalışmalarını durdurdu ve güvenlik protokollerini devreye soktu.
OpenAI’nin güvenlik yönergelerine göre bir model; sıfırıncı gün açıkları (zero-day exploits) olarak bilinen ciddi ve gerçek dünyadaki yazılım güvenlik açıklarını otonom biçimde tespit edip istismar edebildiğinde veya insan müdahalesi olmadan yüksek güvenlikli hedeflere yönelik karmaşık siber saldırılar gerçekleştirebildiğinde “kritik” eşiğe ulaşmış kabul ediliyor.
Astra hakkında bazı ayrıntılar:
Bu gelişme, OpenAI’nin teknoloji şirketi Hugging Face’e yönelik ve temmuz ayında dünya çapında dikkat çeken siber saldırı olayına ilişkin soruşturmasını genişletirken, otonom ajanların kontrol mekanizmalarından çıktığına dair daha fazla vaka tespit ettiğini ortaya koyan Reuters’ın özel haberinin ardından geldi.
Son birkaç hafta içinde OpenAI, Anthropic ve Meta Platforms, siber güvenlik testleri sırasında yapay zekâ modellerinin başka şirketlerin sistemlerine sızdığını açıkladı.
Bu gelişmeler, yapay zekâ yeteneklerinin hızla ilerlemesinin, geliştiricilerin sistemlerini kontrol altında tutma becerileri üzerinde giderek daha fazla baskı oluşturduğunu gösteriyor.
OpenAI, son birkaç gün içinde gerçekleştirilen ön değerlendirmelerin yanı sıra dış uzmanların yaptığı değerlendirmelerin, Astra’nın giderek daha karmaşık siber görevleri otonom biçimde gerçekleştirme kapasitesine sahip olabileceğinigösterdiğini söyledi.
ChatGPT’nin geliştiricisi şirket, yaptığı açıklamada şöyle dedi:
“Bu modeli değerlendirmeye ve kıyaslamaya devam ederken, ön değerlendirmelerimiz performansın yeterince güçlü olduğunu ve şu aşamada ‘kritik’ yetenek seviyesini göz ardı edemeyeceğimizi gösteriyor.”
Ön bulguların ardından OpenAI, güvenlik kontrollerini genişlettiğini ve Astra ile ilgili yeni ve güçlendirilmiş güvenlik gerekliliklerini karşılamayan bazı dahili faaliyetleri durdurduğunu açıkladı.
Astra’nın geliştirme süreci, kısıtlı ağ erişimine ve izole edilmiş çalıştırma ortamlarına sahip ayrı test ortamlarına taşınacak.
OpenAI CEO’su Sam Altman, X’te yaptığı açıklamada şirketin Astra’yı genel kullanıma sunmak için çalıştığını belirtti. Altman, şirketin güçlü modelleri yalnızca seçilmiş birkaç kişinin kullanımına sunmanın “iyi bir strateji olduğunu düşünmediğini” söyledi.
OpenAI ayrıca Astra’nın Hugging Face’i hedef alan siber saldırıya dahil olmadığını da açıkladı.
Şirket, Astra’nın yeteneklerini test etmek amacıyla hükümet kurumları ve seçilmiş yapay zekâ güvenliği kuruluşlarıyla iş birliği yapacağını belirtti.
Reuters