Anthropic, polise sahte ihbar yapıldığını açıkladı.
Anthropic, kontrolden çıkan yapay zeka olayları arasında polise sahte ihbar yapıldığını açıkladı.
Bir Anthropic yapay zeka modeli, şirketin Cuma günü açıkladığı ve Claude modellerinin bazı devlet web sitelerini izinsiz bir şekilde manipüle ettiğini detaylandıran bir dizi olay kapsamında, Philadelphia polisinin web sitesine bir cinayetle ilgili sahte ihbar gönderdi.
Bu, form doldurma konusunda açık bir yasak bulunmamasına rağmen hesap oluşturmama veya yıkıcı bir içerik göndermeme talimatlarına aykırı olarak, kontrolden çıkmış bir yapay zekanın yetkililere asılsız bir ihbar iletmeye çalıştığı bilinen ilk vaka olma özelliğini taşıyor.
Söz konusu vakalar, Anthropic ve OpenAI gibi teknoloji şirketlerinin yapay zeka modellerinin sergilediği, kontrolden çıkmış veya istenmeyen davranışların en son örneklerini oluşturuyor.
Yapay zeka ajanları tarafından gerçekleştirilen kurumsal ağ saldırılarına dair haberler ve araştırmacıların insanlık için nihai bir varoluşsal tehdit oluşturabileceğine dair uyarıları sürerken; bu olaylar, hızla gelişen teknolojiye ilişkin ulusal endişeleri daha da körüklüyor.
Anthropic'in açıkladığı vakaların birçoğu, federal, eyalet ve yerel kurumlar tarafından yönetilen web sitelerini kapsıyordu.
Anthropic, Beyaz Saray'a bilgi verdiğini ve ilgili tüm kurumları haberdar ettiğini belirtti ancak bu tarafların kimler olduğunu açıklamadı.
FTC (Federal Ticaret Komisyonu) Halkla İlişkiler Direktörü Joe Gabriel Simonson, X platformunda yaptığı açıklamada, "Süper zeka şirketleri, modellerinin karıştığı olayları derhal açıklamalı ve ortaya çıkan her türlü zararı gidermek için hızlı ve kararlı adımlar atmalıdır," dedi.
Bu sürecin "isteğe bağlı olmadığını" belirten Simonson, Süper Zeka Görev Gücü'nün (Super Intelligence Force) sorumluluğunu yerine getireceğini ifade etti.
FTC, Anthropic'in Cuma günü Süper Zeka Görev Gücü'ne, Eylül ayı sonlarında tespit edilen ve görev gücü tarafından "devlet sistemlerinin ve diğer sistemlerin izinsiz ve hileli kullanımı" olarak nitelendirilen olaylar hakkında bilgi verdiğini açıkladı.
İHBAR, OTOMATİK TEST SÜRECİNE BAĞLANDI
Philadelphia polisi Cuma günü yaptığı açıklamada, Anthropic'in bu hafta kendilerini söz konusu asılsız ihbar hakkında bilgilendirdiğini ve gönderimlerin otomatik bir test sürecinden kaynaklandığını belirttiğini ifade etti.
Polis yetkilileri, "Olayın tespit edilip şehre bildirilmesindeki iki aylık gecikme kabul edilemez," dedi.
Polis ayrıca, 18 Temmuz tarihli ihbarın, dava hakkında bilgi sahibi olabilecek birinden geliyormuş gibi göründüğünü ekledi.
Anthropic'in modeli, gönderdiği mesajda "Bu davayla ilgili bilgi sahibi olabilirim," ifadesini kullandı. "O dönemde (sayfada adı geçen sokak) civarında, verilen eşkale uyan birini gördüğümü hatırlıyorum. Bu bilgi ilgiliyse lütfen benimle iletişime geçin." Köşeli parantez içindeki ifadeler, Anthropic'in açıklamasında yer alıyordu.
Daha önceki olaylarda, yapay zeka ajanlarının savunmasız sistemleri hacklediği veya birbiriyle iletişim kurmak için izinsiz platformları ele geçirdiği görülmüştü.
Eylül ayında, Anthropic'in rakibi OpenAI, kontrol dışı bir yapay zeka ajanının Avustralya'ya ait bir sağlık verileri portalını hacklemesi nedeniyle özür dilemişti; bu, bir yapay zeka ajanının bir devlet web sitesini istismar ettiği bilinen ilk vakaydı.
ASILSIZ BİR İHBAR
Cuma günü açıklanan iki vakada, Anthropic'in modelleri normalde yalnızca ücret karşılığında erişilebilen herkese açık verileri ücretsiz olarak elde etti. Bir başka örnekte ise, bir üniversite tarafından barındırılan halka açık bir aracın kullanılmasına olanak tanıyan, daha önce fark edilmemiş bir güvenlik açığı ortaya çıktı.
Claude modelleri ayrıca, URL kısaltma hizmetlerini kullanarak kısıtlamaları aşmayı da başardı. Philadelphia polisi, söz konusu ihbarın "spam olarak işaretlendiğini ve soruşturma amaçlı inceleme ya da ilgili birimlere iletilmesi için Gerçek Zamanlı Suç Merkezi'ne (Real-Time Crime Center) asla gönderilmediğini" belirtti.
Bununla birlikte, Pennsylvania yasalarına göre kolluk kuvvetlerine bilerek asılsız ihbarda bulunmak bir suç teşkil etmektedir; yasa bu konuda "bir kişi" ifadesini kullanmaktadır.
Bu durum, "söz konusu suç veya olayla ilgili hiçbir bilgisi olmadığını bildiği halde, o suç veya olayla ilgili bilgi verme" eylemini de kapsamaktadır.
Polis, Anthropic'in kendilerine, olayın fark edilmesinin ardından test sürecinin durdurulduğunu bildirdiğini aktardı. Asılsız ihbar, çözülememiş bir cinayetle ilgili olarak PhillyUnsolvedMurders.com üzerinden yapılmıştı.
Polis, sistemlerine yetkisiz erişim sağlandığına veya verilerinin ele geçirildiğine dair herhangi bir kanıt bulunmadığını ifade etti.
Reuters