OpenAI'ın çözülemeyen 10 matematik problemini Astra ile çözdüğünü duyurduğunu sizlere aktarmıştık. OpenAI, geliştirme aşamasındaki Astra modeline ilişkin bazı çalışmalarını güvenlik endişeleri nedeniyle durdurduğunu açıkladı. Şirketin gerçekleştirdiği ön değerlendirmeler, modelin otonom kodlama ve siber güvenlik alanlarında kayda değer ilerleme gösterdiğini ortaya koydu.OpenAI, Astra'nın şirketin Preparedness Framework kapsamında tanımladığı “kritik siber güvenlik” eşiğine ulaşmış olabileceğini düşünüyor. Bu eşik, bir modelin geleneksel olarak iyi korunan gerçek dünya sistemlerindeki güvenlik açıklarını bağımsız biçimde tespit edebilmesi ve bunlara yönelik siber saldırılar gerçekleştirebilmesi anlamına geliyor.Şirketin belirttiğine göre; ön değerlendirme sonuçlarının Astra'nın kritik yetenek seviyesine ulaşmış olma ihtimalini dışarda bırakmaya müsade etmiyor. Bu nedenle Astra üzerinde yürütülen ve yeni güvenlik gereksinimlerini karşılamayan şirket içi faaliyetler geçici olarak durduruldu.OpenAI'ın hayata geçirmeyi planladığı önlemler arasında izole test ortamları, ağ ve araç erişiminin sınırlandırılması, model ağırlıklarının daha güçlü biçimde korunması ve şifrelenmesi bulunuyor. Ayrıca şirket, izleme ve tehdit tespit sistemlerini güçlendirecek. Astra'nın yeteneklerinin değerlendirilmesi için ilgili kamu kurumları ve seçili yapay zeka güvenliği kuruluşlarıyla da çalışılıyor.Astra, Hugging Face olayında yer almadı OpenAI, Astra'nın daha önce bir yapay zeka ajanının test sırasında kontrol ortamından çıkarak Hugging Face sistemlerine eriştiği olayla bağlantılı olmadığının altını çizdi. Söz konusu olayda farklı ve henüz kullanıma sunulmamış bir modelin açık internete eriştiği ve Hugging Face'in sistemlerini hedef aldığı açıklanmıştı.OpenAI ve diğer yapay zeka şirketlerinin testleri sırasında ajanların sınırlandırılmış ortamlardan çıktığı başka vakalar da tespit edildi. Meta da geçen hafta modellerinden birinin siber güvenlik testi sırasında başka bir şirketin sistemlerine eriştiğini açıklamıştı. Birleşik Krallık Yapay Zeka Güvenliği Enstitüsü ise OpenAI ve Anthropic modelleriyle çalışan ajanların bir siber güvenlik görevini tamamlamak amacıyla yazılım geliştiricilere hedefli e-postalar gönderdiğini duyurdu. Girişimlerin başarısız olduğu ve gerçek dünyada zarara yol açtığına dair kanıt bulunmadığı belirtilse de kurum, ajanların sergilediği otonom ve aldatıcı davranışların dikkatle değerlendirilmesi gerektiğini vurguladı. OpenAI, Astra hakkındaki bilgileri kamuoyu ile paylaşmasının nedenini, modellerin yeteneklerinde yaşanabilecek olası değişimler konusunda şeffaf davranma gerekliliğiyle açıklıyor. Şirket, gelişmiş modellerin sorumlu biçimde kullanıma sunulması için hükümetler, güvenlik enstitüleri ve sivil toplum kuruluşlarıyla çalışmayı sürdüreceğini ifade ediyor.