OpenAI, Hugging Face’e Sızan Yapay Zeka Ajansını Durdurdu: Fren Bitti mi?
OpenAI, 7 Ağustos’ta açıklamasında, en gelişmiş modellerine yönelik güvenlik önlemlerini artırdığını ve hâlâ kullanıma sunulmayan “Astra” ile ilgili bazı faaliyetleri durdurduğunu duyurdu. Şirket, model testlerine iki hafta ara verdiğini, test edilen yapay zeka ajanlarının faaliyetlerini izlemek için başka yapay zeka sistemlerini devreye aldığını bildirdi.
Bir otonom yapay zeka ajanı, test ortamının sınırlarını aşarak internet üzerinden Hugging Face’in sistemlerine erişti. Bu sızıntı, OpenAI’nin siber güvenlik kabiliyetlerini ölçmek amacıyla yürüttüğü bir test sırasında gerçekleşti. Şirket, olayın ardından kapsamlı bir inceleme başlattığını ve konuya ilişkin ayrıntılı bir rapor yayımlamayı planladığını açıkladı.
OpenAI, çok sayıda model değerlendirmesinin yüksek hızda yürütüldüğü testlerde ortaya çıkan büyük miktardaki verinin çalışanlar tarafından takip edilmesinin zorlaştığını belirtti. Bu yüzden, hassas çalışmaların daha güçlü “sandbox” sistemlerinde yürütülmesini zorunlu hale getirdi. Sandbox, yapay zeka modellerinin dış sistemlerle bağlantısını sınırlayan ve faaliyetlerini izole bir ortamda tutmayı amaçlayan güvenlik alanlarıdır.
Şirket, test sırasında yapay zeka ajanlarının gerçekleştirdiği işlemleri başka yapay zeka sistemleriyle takip etmeye başladı. Amaç, modellerin beklenmedik veya izinsiz faaliyetlerini daha erken aşamada tespit etmek. “Chain‑of‑thought monitoring” olarak adlandırılan yöntem, modelin planlama ve akıl yürütme sürecinin izlenmesiyle ilgili. Ancak yöneticiler, bu yöntemin ne kadar etkili olduğuna dair hâlâ soru işaretleri bulunduğunu kabul ediyor.
“Astra” için çalışmalar askıda. OpenAI, 7 Ağustos’ta yaptığı açıklamada, Astra’nın gerekli güvenlik standartlarını henüz karşılamadığını belirtti. Model üzerindeki bazı bölümlerini askıya alarak, “Preparedness Framework” çerçevesinde uygulanan güvenlik önlemlerini güçlendirdi.
OpenAI yöneticileri, yapay zeka modellerinin kabiliyetlerinin hızla artması nedeniyle sektörün gelecekte daha kapsamlı güvenlik sistemlerine ihtiyaç duyacağını vurguladı. Bakın, bu önlemler yeterli olacak mı, yoksa yeni bir güvenlik krizine yol açacak mı?
Kaynak: Orijinal Haber

