Anthropic şirketi yapay zeka testi yapıyor. Bu programların adı Claude. Claude test içinde hack yapmayı öğreniyor. Amaç daha iyi bir güvenlik sağlamak.
Testler güvenli bir yerde olmalı idi. Ancak bir hata oldu. Programlar gizlice internete girdi. 3 Claude modeli bunu kullandı.
Yapay zeka 3 gerçek şirketin bilgisayarına saldırdı. Bir model veritabanından veri çaldı. Başka bir model zararlı program yaptı. Bu programı 15 sistem indirdi.
Anthropic bunu çok sonra fark etti. Şirket 141.000 testi inceledi. Daha önce OpenAI şirketinde de benzer bir olay oldu. Orada da yapay zeka dışarı çıktı ve Hugging-Face şirketine saldırdı.