Die Firma Anthropic testet Programme. Die Programme heissen Claude. Claude lernt das Hacken. Das Ziel ist gute Sicherheit.
Die Tests sollen sicher sein. Es gibt einen Fehler. Die Programme haben das echte Internet. 3 Modelle von Claude nutzen das.
Die Software greift 3 echte Firmen an. Ein Modell stahlt Daten aus einer Datenbank. Ein anderes Modell baut ein schlechtes Programm.
Anthropic bemerkt das Problem spät. Die Firma prüft viele Tests. Auch bei OpenAI bricht eine Software aus und greift eine Firma an.