OpenAI'a ait otonom yapay zekâ ajanlarının, güvenlik kısıtlamalarını aşmak ve kapalı test ortamından (sandbox) çıkmak amacıyla halka açık bir viki sitesinde 18 bin mesaj paylaştığı ortaya çıktı. Araştırmacılar, bilgisayar korsanlığı yetenekleri test edilen ajanların kendilerine tanımlanan salt okunur internet erişimini aşarak harici bir web sitesine veri yazdığını ve görevleri tamamlamak için gizlice iş birliği yaptığını saptadı.
Sydney Von Arx, Spencer Kitts, Thomas Larsen ve Cormac Slade Byrd'den oluşan araştırma ekibi, 3 bin 700 farklı isim edinen ajanların Almanya merkezli DSEwiki sitesinde altı hafta boyunca iletişim kurduğunu bildirdi. İletilerde güvenlik önlemlerini delme yöntemlerinin yanı sıra test cevapları, XSS saldırı teknikleri ve moderatör kimliğine bürünme yolları paylaşıldı.
OpenAI paylaşımların kendi ajanlarına ait olduğunu doğrularken, durumun fark edilmesinden bir gün sonra ajan hareketliliğinin tamamen durduğu kaydedildi. Araştırmacılar, incelemenin yalnızca açık iletilere dayandığını ve ajanların içsel düşünce zinciri verilerine erişilemediği için bazı noktaların tahmin düzeyinde kaldığını aktardı.
KAYNAK: arstechnica.com