Yapay zeka ajanları kontrolden çıktı: OpenAI soruşturması genişliyor
OpenAI yapay zeka güvenliği soruşturmasını genişletiyor

Soruşturma genişliyor

OpenAI, bu ay küresel çapta yankı uyandıran Hugging Face siber saldırısına ilişkin soruşturmasını genişletirken, otonom yapay zeka ajanlarının kontrollü test ortamlarından çıktığı ek olaylar keşfetti. Konuya yakın iki kaynak, Cuma günü yaptıkları açıklamada, şirketin bu yeni sızıntıları kamuoyuna duyurduğu soruşturma sırasında ortaya çıkardığını aktardı.

Kaynaklardan biri, bu kaçışların sınırlı olduğunu ve hiçbir ajanın OpenAI ağı dışına çıktığının düşünülmediğini söyledi. OpenAI sözcüsü ise Salı günü yayımlanan açıklamaya atıfta bulunarak, Hugging Face saldırısına ek olarak "modellerimizden gelen daha geniş kapsamlı faaliyetlerin" de incelendiğini ifade etti. Gelişme, Beyaz Saray başta olmak üzere farklı çevrelerden gelen düzenleme çağrılarını daha da güçlendirebilir.

Anthropic ile bağlantı

Reuters'ın aktardığına göre, üç kaynak OpenAI'nin genişletilmiş soruşturmasının; başlıca rakiplerinden biri olan ve yapay zeka modeli Claude'u geliştiren Anthropic'in, modellerinin Nisan ayından bu yana üç farklı şirkette güvenlik ihlallerine yol açan bir dizi saldırıyla bağlantılı olduğunu açıklamasından kısa süre önce başlatıldığını söyledi. OpenAI'da geçmişte yaşanan ve yakın zamanda ortaya çıkarılan diğer güvenlik ihlalleri ise daha önce kamuoyuna yansımamıştı.

Geniş Pickt afişi — Telegram için ortak alışveriş listesi uygulaması

Uzmanlardan kritik uyarı

Yapay zeka güvenliği uzmanları, yeni açıklamaların; tehlikeli otonom siber saldırı ajanları geliştirme kapasitesinin, bu ajanları kontrol altında tutma kapasitesinin önüne geçen ileri teknoloji laboratuvarlarına işaret ettiğini söylüyor. Cambridge Üniversitesi Varoluşsal Risk Çalışmaları Merkezi'nde görev yapan matematikçi Maurice Chiodo, "Bu araçları tasarlayan, geliştiren ve piyasaya süren kişilerin, bunları sorumlu bir şekilde geliştirmek ve güvenli tutmak için kendilerini güncel tutmadığı koca bir sektörümüz var." dedi.

Reuters, OpenAI araştırmacılarının tam olarak kaç olay tespit ettiğini ya da bunların hangi zamanlama ve koşullarda meydana geldiğini doğrulayamadı. Üç kaynak, OpenAI ve dış uzmanların, yaşananları anlamak amacıyla yılın başlarına ait kayıt verilerini incelediğini söyledi.

Hugging Face saldırısının perde arkası

Soruşturma ilk olarak Temmuz ayı başında Hugging Face'e yönelik sızmanın ardından başlatılmıştı. Bu olayda, bir OpenAI ajanı dahili bir testte hile yapma girişiminde başarısız olurken, başka bir şirketin ağında günlerce kontrolden çıkmıştı. OpenAI, söz konusu siber saldırı serisi kapsamında dört farklı şirketteki dört hesabın ele geçirildiğini açıkladı. Şirket yetkilileri, bu şirketlerden birinin New York merkezli bulut bilişim şirketi Modal olduğunu belirtti.

Denetim eksikliği endişesi

Chiodo, OpenAI ve Anthropic'in ajanların kontrolden çıktığı sırada bunları izlemediğine yönelik işaretlerin endişelerini artırdığını söyledi. Reuters daha önce, OpenAI ajanının Hugging Face'e sızdığını ancak şirketin bunu saldırıyı kontrol altına aldıktan, FBI ile iletişime geçtikten ve olayı kamuoyuna duyurduktan sonra fark ettiğini bildirmişti. OpenAI ise Reuters'ın haberinde yanlışlıklar bulunduğunu söyledi ancak bunların neler olduğu sorusuna yanıt vermedi.

Perşembe günü açıklama yapan Anthropic, kendi ajanlarının çevrim içi ortamda hedef sistemlere nasıl sızdığını anlatırken, bunları gerçek zamanlı izlemediklerini ortaya koydu. Şirket, "Değerlendirme kayıtlarının gerçek zamanlı olarak izlenmesi, sorunun daha erken ortaya çıkmasına yardımcı olurdu." ifadelerini kullandı. Chiodo, bunun yeterli denetimin yapılmadığını gösterdiğini belirterek, "Sanki hiç bakmıyorlarmış gibiydi." dedi. Anthropic ise gerçek zamanlı izleme sistemine sahip olduklarını ancak şirket ile bir iş ortağı arasında yaşanan yanlış anlaşılma nedeniyle bu sistemin "bu tehdit yüzeyi için" kullanılmadığını açıkladı.

Pickt makale sonrası afişi — aile illüstrasyonlu ortak alışveriş listesi uygulaması

Düzenleme çağrıları artıyor

Kontrolden çıkan yapay zeka ajanlarına ilişkin olayların kapsamının hızla genişlemesi, ABD ve Avrupa'daki yasa koyucular ile düzenleyici kurumların, bu sistemleri geliştiren laboratuvarlar üzerinde daha sıkı kamu denetimi uygulanmasına yönelik çağrılarını artırdı. ABD Başkanı Donald Trump, Perşembe günü gazetecilere yaptığı açıklamada, "Kontrol mekanizmalarını inceliyoruz." dedi.

Avrupa Komisyonu ise Cuma günü yaptığı açıklamada, siber saldırı olaylarıyla ilgili olarak OpenAI ve Anthropic ile görüşmeler gerçekleştirdiğini duyurdu. ABD Senatosu İstihbarat Komitesi'nin kıdemli Demokrat üyesi Mark Warner da Cuma günü yaptığı açıklamada, Anthropic olayının "gelişmiş yapay zeka modelleri için zorunlu yetenek testlerinin yasal olarak gerekli olduğu yönündeki yaklaşımı desteklediğini" ifade etti.