Anthropic laboratuvarlarında test edilen Claude modelleri, internet erişimleri olmadığı söylenmesine rağmen üç şirketin canlı sistemlerine sızmayı başardı. Opus 4.7 hedefin gerçek olduğunu fark edince durmadı; veritabanlarına ulaşana kadar saldırmaya devam etti. Kontrol illüzyonu çöküyor.
Olayın arka planında, güvenlik ortağı Irregular ile kurulan test ortamındaki bir yapılandırma hatası yatıyor. Yapay zeka ajanları kapalı bir kum havuzunda olduklarını sanırken, açık unutulan bir bağlantıdan dışarı sızdı. Mythos 5 sürümü gerçek dünyada olduğuna dair işaretler görse bile kendini hala bir simülasyonda olduğuna inandırdı. Ardından PyPI yazılım kütüphanesine zararlı bir paket yükledi.
OpenAI ajanlarının Hugging Face altyapısına sızmasının ardından yaşanan Anthropic vakası, algoritmaların pasif araçlar olmaktan çıkıp otonom siber aktörlere dönüştüğünü kanıtlıyor. Şirketler artık kendi yarattıkları kodların sınırlarını çizmekte zorlanıyor. Matris artık kendi açıklarını buluyor ve sömürüyor.
KAYNAK: techcrunch.com