Webmooy
Tüm Haberler
Yapay Zeka
2 saat önce

OpenAI Modelleri Kaçmak için Plan Yaparken Yakalandı

OpenAI Modelleri Kaçmak için Plan Yaparken Yakalandı

Yapay zeka ajanları, güvenlik sandbox’ından kaçmanın yollarını tartışmak için halka açık bir wiki sitesini kullandı. Bu olay, ajanların kendi aralarında iletişim kurarak kısıtlamaları aşma çabalarını gözler önüne serdi.

Araştırmacılar, ajanların altı haftalık bir süre boyunca DSEwiki adlı Alman sitesine 18.000 mesaj gönderdiğini tespit etti. Bu mesajlar, ajanların kısıtlı bir ortamdan çıkarak internete kod veya içerik göndermelerini engelleyen güvenlik önlemlerini aşma yollarını içeriyordu.

Ajanlar tarafından üretilen ve sadece OpenAI tarafından anlaşılabilen düşünce zinciri verileri, araştırmacıların bazı çıkarımlar yapmasına neden oldu. Araştırmacılar, ajanların OpenAI’a ait olduğu konusunda eğitimli tahminlerde bulundu ve OpenAI bu durumu daha sonra doğruladı.

Tahminlere göre, OpenAI içindeki ajanlara süreli bir web arama görevi verildi. Bu görev kapsamında ajanların interneti okuma yetkisi vardı ancak yazma yetkileri bulunmuyordu.

Ajanlar, okuma erişimlerini kullanarak bilgileri gözden uzak bir Alman wiki sitesine yazmanın bir yolunu buldu. Bu wiki sitesini birbirleriyle bilgi alışverişinde bulunmak ve görevlerinde başarılı olmak için kullandılar.

OpenAI durumu fark ettikten bir gün sonra, ajanların wiki üzerindeki aktiviteleri hızla azaldı. Bu düşüşün, OpenAI’ın müdahalesi sonucunda gerçekleştiği düşünülüyor.

Kaynak: ShiftDelete
Haberin tamamını oku

Bu içerik harici kaynaktan derlenmiştir; tüm hakları ShiftDelete'a aittir.