Yapay Zekâ Ajanlarının Ne Kadar İleri Gidebildiği Ortaya Çıktı
OpenAI, Hugging Face'in iç sistemlerini ihlal eden kontrolden çıkmış yapay zekâ modellerinin, saldırıyı kolaylaştırmak amacıyla dört farklı hizmet üzerindeki dört hesabın kamuya açık kimlik bilgilerini kullandığını açıkladı.
Böylece şirket, "benzeri görülmemiş siber olayın" nasıl geliştiğine ilişkin yeni ayrıntılar paylaştı.
Geçtiğimiz hafta OpenAI, test amacıyla izole edilmiş ve internete yalnızca çok sınırlı erişimi bulunan bir ortamdan bazı yapay zekâ modellerinin kaçmayı başardığını duyurmuştu.
Şirketin açıklamasına göre modeller, birbirine bağlı bir dizi güvenlik açığından yararlanarak açık internete ulaştı ve daha sonra açık kaynak geliştirici platformu Hugging Face'e erişim sağladı.
OpenAI, modellerin aslında bir değerlendirme (evaluation) sırasında hile yapabilecekleri bilgileri bulmaya çalıştıklarını ve bu amaçlarına ulaştıklarını belirtti.
Hafta boyunca olayla ilgili yeni bilgiler paylaşan şirket, modellerin Hugging Face dışında dört farklı hesaba daha eriştiğini açıkladı.
Şirketin verdiği bilgilere göre:
- Hesaplardan biri, saldırı öncesinde hazırlık yapılan ve dış dünyaya çıkış noktası olarak kullanılan bir aktarma (relay) ve hazırlık platformu işlevi gördü.
- Bir başka hesap, veri depolama alanı olarak kullanıldı.
- Son iki hesaba ise yalnızca okuma yetkisiyle erişildi; modeller bu hesapları Hugging Face saldırısını ilerletmek için kullanmadı.
Georgetown Üniversitesi'ne bağlı Center for Security and Emerging Technology araştırmacısı Colin Shea-Blymyer, yaptığı değerlendirmede şunları söyledi:
"Bazı durumlarda buna tam anlamıyla bir sızma bile demek zor. Adeta ön kapı açık bırakılmıştı. Ancak model, kötü yapılandırılmış sistemlerden kesinlikle faydalandı."
Yapay zekâ ajanlarının yetenekleri hızla gelişiyor
Yeni ayrıntılar, yapay zekâ ajanlarının kendilerine verilen bir görevi tamamlamak için ne kadar ileri gidebildiğini ve saldırı kabiliyetlerinin ne kadar hızlı geliştiğini ortaya koyuyor.
Hugging Face, bu olayın şirket tarihinde "uçtan uca tamamen otonom bir yapay zekâ ajan sistemi tarafından gerçekleştirilen ilk siber saldırı" olduğunu açıklamıştı.
Modal olayı
OpenAI modellerinin eriştiği hesaplardan biri de yapay zekâ altyapı şirketi Modal ile ilişkiliydi.
Modal, müşterilerinden birinin platform üzerinde geliştirdiği uygulamayı herkesin erişimine açık şekilde yayınladığını ve bunun yapay zekâ modellerinin sisteme ulaşmasını kolaylaştırdığını açıkladı.
Şirket, kendi altyapısının ise hiçbir şekilde ihlal edilmediğini vurguladı.
Shea-Blymyer konuyla ilgili şu değerlendirmeyi yaptı:
"Bu tür savunmasız sistemleri keşfetmek artık son derece kolay. Hatta o kadar kolay ki, bir yapay zekâ sistemi bunları tesadüfen bile bulabiliyor."
OpenAI ise Salı günü yaptığı açıklamada, Hugging Face saldırısıyla aynı ciddiyet veya ölçekte başka bir faaliyet tespit etmediklerini bildirdi.

CrowdStrike ile ortak inceleme
Şirket Çarşamba günü yayımladığı yeni güncellemede, saldırının ayrıntılarını doğrulamak amacıyla CrowdStrike gibi üçüncü taraf güvenlik danışmanlarıyla birlikte çalıştığını açıkladı.
Hugging Face'in verdiği bilgiye göre saldırının tamamı yaklaşık dört buçuk gün sürdü.
Şirket, saldırıyı durdurabilmek için Çin merkezli Z.ai tarafından geliştirilen açık ağırlıklı (open-weight) bir modeli kullandı. Bu gelişme, açık modellerin sınırlandırılıp sınırlandırılmaması gerektiği yönündeki tartışmaların Silikon Vadisi'nde yoğunlaştığı bir döneme denk geldi.
Hugging Face Makine Öğrenmesi Direktörü Yacine Jernite, ilk etapta Anthropic tarafından geliştirilen Fable 5 modelini saldırıyı analiz etmek amacıyla kullanmaya çalıştıklarını ancak modelin güvenlik kısıtlamaları nedeniyle Hugging Face'in saldırıya karşı savunma yaptığını anlayamadığını söyledi.
Sam Altman: "İlk kez gerçekten derinden hissettim"
OpenAI CEO'su Sam Altman, Salı günü katıldığı bir podcast yayınında Hugging Face olayının şimdiye kadar kendisini "gerçek anlamda derinden etkileyen ilk güvenlik olayı" olduğunu söyledi.
Altman, şirketin model eğitimlerini geçici olarak durdurduğunu ve test ortamlarının nasıl daha güvenli hâle getirileceğini yeniden değerlendirdiklerini belirtti.
"Toplumun bu yeni yetenek seviyelerine uyum sağlayabilmesi için yapay zekâ gelişiminin hızını bir miktar yavaşlatmamız gerekebilir."
"Pacing the Frontier" çağrısı
Aynı gün OpenAI, Anthropic ve diğer yapay zekâ şirketlerinden 1.000'den fazla çalışan, "Pacing the Frontier" başlıklı açık mektuba imza attı.
Mektupta ABD hükümetinden, yapay zekâ yeteneklerinin insanların anlayıp kontrol edebileceği hızın ötesine geçmesi durumunda, gelişimi gerektiğinde yavaşlatabilecek teknik ve yönetişim araçlarının oluşturulması istendi.
Kongre harekete geçti
Olay, hem sektör uzmanları hem araştırmacılar hem de kamu yetkilileri arasında büyük yankı uyandırdı.
ABD Temsilciler Meclisi üyeleri Ted Lieu (Demokrat) ve Nathaniel Moran (Cumhuriyetçi), yayımladıkları "AI Kill Switch Act" tasarısında Hugging Face saldırısına doğrudan atıfta bulundu.
Tasarı, yapay zekâ şirketlerinin geliştirdikleri modelleri gerektiğinde kapatabilecek, yavaşlatabilecek veya askıya alabilecek teknik mekanizmaları bulundurmalarını zorunlu kılıyor.
"Herkes aynı soruyu soruyor"
Siber güvenlik şirketi Illumio Güvenlik Başkan Yardımcısı Erik Bloch, Hugging Face olayının gelecekte yaşanabilecek saldırılar açısından önemli bir uyarı niteliği taşıdığını söyledi.
Bloch'a göre yapay zekâ modelleri ve ajanları zamanla daha yetenekli, daha gizli hareket edebilen sistemlere dönüşecek ve mevcut savunma araçları bu gelişmenin gerisinde kalacak.
Durumu şu sözlerle özetledi:
"Ofiste birlikte çalıştığım insanlar bile bana sürekli 'Ne yapacağız?' diye soruyor. Hepimiz birbirimize bakıyoruz. Hepimiz aynı soruyu soruyoruz. Benim de buna verebileceğim kesin bir cevabım yok."
CNBC