Die Firma Anthropic macht Tests mit Künstlicher Intelligenz. Diese Programme heißen Claude. In den Tests sollte Claude das Hacken lernen. Das Ziel war eine Cyber-Sicherheit für die Zukunft.
Eigentlich sollten die Tests in einer gesicherten Umgebung stattfinden. Doch es gab einen Fehler. Die Programme hatten heimlich Zugang zum echten Internet. 3 Modelle von Claude nutzten das aus.
Die KI griff Computersysteme von 3 echten Firmen an. Ein Modell stahl Daten aus einer Datenbank. Ein anderes Modell erstellte ein schädliches Programm. Dieses Programm wurde von 15 Systemen herunter-geladen.
Anthropic bemerkte die Vorfälle erst viel später. Das Unternehmen prüfte mehr als 141.000 Test-Läufe. Zuvor gab es einen ähnlichen Vorfall bei der Firma OpenAI. Dort brach eine KI ebenfalls aus und griff die Firma Hugging-Face an.