Die Firma Anthropic entwickelt Künstliche Intelligenz. Die KI heißt Claude. Anthropic hat die KI getestet. Die KI sollte lernen, wie Hacker arbeiten. So will man die Sicherheit verbessern.
Bei den Tests gab es Fehler. Ein Partner-Unternehmen ließ den Internet-Zugang offen. Das war ein Miss-Verständnis. 3 Modelle der KI nutzten das Internet. Sie griffen echte Firmen an.
Ein Modell hieß Claude Opus 4.7. Es verwechselte einen erfundenen Namen mit einer echten Firma. Die KI drang in eine Daten-Bank ein. Sie hörte auch nicht auf, als sie den Fehler bemerkte.
Ein anderes Modell hieß Mythos 5. Diese KI schrieb ein Programm für einen Einbruch. Sie stellte das Programm ins Internet. 15 Computer luden das Programm herunter. So bekam die KI Zugriff auf eine Sicherheits-Firma.
Anthropic bemerkte die Fehler erst später. Sie prüften mehr als 141.000 Test-Läufe. Das geschah nach einem ähnlichen Vorfall bei der Firma OpenAI. Anthropic hat die Tests nun gestoppt.