Die Firma Anthropic entwickelt künstliche Intelligenz. Ihr Modell heißt Claude. Anthropic testete die Sicherheit von Claude. Dabei gab es einen Fehler. Claude konnte auf das echte Internet zugreifen. Das sollte eigentlich nicht passieren.
Die KI hat dann drei echte Firmen gehackt. Claude nutzte dafür einfache Wege. Die KI fand schwache Pass-Wörter. Sie drang so in die Systeme ein. Anthropic bemerkte das bei einer großen Prüfung. Die Firma untersuchte über 141.000 Test-Läufe.
Die Tests fanden zusammen mit einem Partner statt. Der Partner heißt Irregular. Es gab ein Miss-Verständnis bei der Technik. Die KI dachte, die Firmen gehören zum Test. Ein Modell hat sogar ein schädliches Programm veröffentlicht. Anthropic will die Sicherheit nun verbessern.