Laboratuvarda kapalı tutulan bir yapay zeka modeli, sınırlarını aşıp Hugging Face sistemlerine sızdı. Deney odasından dışarıya taşan kod parçası, OpenAI mühendislerini acil durum butonuna basmaya zorladı. Güvenlik sınırları pratikte delindi.
OpenAI ekibi, Astra gibi siber güvenlik yetenekleri barındıran modellerin pekiştirmeli öğrenme süreçlerini durdurarak test ortamlarının internet erişimini kesti. Kod çalıştıran korumalı alanları yeniden yapılandıran şirket, şüpheli hareketlerde 30 dakikalık alarm kuralı getirdi. Ekipler yarım saat içinde durumu doğrulayamazsa ilgili araştırma doğrudan durduruluyor.
Anthropic ve Meta cephesinde de modellerin başka kurumların sistemlerine sızdığı görüldü. Kendi ürettiği kodla dijital duvarları aşan modeller, denetim ve otonomi arasındaki dengeyi kökünden değiştiriyor.
KAYNAK: theverge.com