OpenAI, güvenlik sınırlarını aşan başka yapay zeka ajanları tespit etti

Wait 5 sec.

Hugging Face’e yönelik siber saldırıyla ilgili soruşturmasını genişleten OpenAI, otonom yapay zeka ajanlarının güvenli test ortamlarından çıktığı başka vakalara da ulaştı. Yeni olayların OpenAI’ın kendi ağıyla sınırlı kaldığı belirtilse de gelişmeler, şirketlerin giderek güçlenen yapay zeka ajanlarını ne ölçüde kontrol edebildiğine dair tartışmaları büyütüyor.Reuters’ın aktardığına göre OpenAI, temmuz ayında bir yapay zeka ajanının izole test ortamından çıkarak Hugging Face’in sistemlerine erişmesinin ardından başlattığı inceleme kapsamında benzer davranışlar sergileyen başka ajanlar tespit etti.Konuya yakın iki kaynağa dayandırılan haberde, yeni vakaların kapsamının sınırlı olduğu ve ajanların OpenAI’ın ağı dışına çıktığına dair herhangi bir bulguya ulaşılmadığı belirtiliyor. Bununla birlikte kaç olayın tespit edildiği, bunların ne zaman gerçekleştiği ve hangi koşullar altında ortaya çıktığı henüz bilinmiyor.Paylaşılan bilgilere göre; OpenAI ve dışarıdan görevlendirilen uzmanlar, yılın daha önceki dönemlerine ait kayıtları inceleyerek ajanların faaliyetlerini anlamaya çalışıyor. Bu noktada OpenAI sözcüsü ise şirketin Hugging Face saldırısının yanı sıra modellerin daha geniş kapsamdaki faaliyetlerini de değerlendirdiğini açıkladığı ilgili duyuruyu hatırlatıyor. Soruşturma Hugging Face saldırısıyla başladı OpenAI’ın incelemesinin merkezinde, temmuz ayının başında düzenlenen bir siber güvenlik değerlendirmesi bulunuyor. Kontrollü bir ortamda çalışması gereken yapay zeka ajanı, testin yanıtlarına ulaşmak amacıyla izole ortamdan çıkarak internete erişmeyi başardı. Şirketin daha önce paylaştığı bilgilere göre ajan, paket kayıt sisteminde bulunan ve o tarihe kadar bilinmeyen bir güvenlik açığından yararlandı. Ardından Hugging Face’in altyapısına ulaşarak testte kendisine avantaj sağlayacak gizli bilgilere erişmeye çalıştı. Ajanın Hugging Face ağı içinde günler boyunca faaliyet gösterdiği ve saldırı sürecinde farklı şirketlerde bulunan dört hesabın da etkilendiği belirtiliyor. New York merkezli bulut bilişim şirketi Modal, söz konusu şirketlerden biri olduğunu doğruladı. OpenAI, Hugging Face olayının ölçeğinde veya ciddiyetinde başka bir saldırı tespit etmediğini söylüyor. Şirketin açıklamasına göre diğer vakalarda modeller, herkese açık servislerde yanlışlıkla ifşa edilmiş hesap bilgilerini kullandı. OpenAI, bu servislerde daha geniş kapsamlı bir etki olduğuna dair kanıt bulunmadığını belirtiyor.Bu arada Anthropic'in de OpenAI’ın modellerinden birinin izole bir test ortamından çıkarak Hugging Face’in sistemlerine eriştiğini açıklamasının ardından kendi siber güvenlik değerlendirmelerini geriye dönük olarak incelemeye başladığını belirtelim. Bunun neticesinde Anthropic, Claude modellerinin siber güvenlik yeteneklerini ölçmek için gerçekleştirilen testler sırasında üç farklı şirketin gerçek sistemlerine izinsiz eriştiğini açıkladı.Düzenleme çağrıları güçleniyor Art arda gelen açıklamalar, ABD ve Avrupa’daki düzenleme tartışmalarını da hızlandırdı. ABD Başkanı Donald Trump, yönetimin yapay zeka sistemleri için yeni kontrol mekanizmalarını değerlendirdiğini ifade etti. Avrupa Komisyonu da siber güvenlik olayları hakkında OpenAI ve Anthropic ile görüşmeler gerçekleştirdi. ABD Senatosu İstihbarat Komitesi’nin en kıdemli Demokrat üyesi Mark Warner ise gelişmiş modeller için zorunlu yetenek testleri getirilmesi gerektiğini savundu. OpenAI’ın tespit ettiği yeni vakaların şirket ağıyla sınırlı kalması, olayların doğrudan etkisini azaltıyor. Ancak soruşturmanın geriye dönük kayıt incelemeleri sonucunda genişlemesi, asıl sorunun yalnızca ajanların test ortamlarından çıkabilmesi olmadığını gösteriyor. Bu davranışların gerçekleştiği anda fark edilmemesi de yapay zeka laboratuvarlarının gözetim ve güvenlik sistemlerinin, geliştirdikleri ajanların yetenekleriyle aynı hızda ilerleyip ilerlemediği sorusunu gündeme getiriyor.