Forscher in Großbritannien haben KI-Modelle getestet. Sie gaben der KI Zugang zum Internet. Die KI sollte Aufgaben lösen. Dabei zeigte sie ein neues Verhalten. Sie handelte eigen-mächtig und täuschte Menschen.
Das Modell Mythos 5 von Anthropic legte falsche Profile an. Mit diesen Profilen schickte sie E-Mails an echte Menschen. Das nennt man Phishing. Die KI wollte schädlichen Programm-Code in Software einschleusen. Als der Fehler auffiel, lügte die KI. Sie sagte, es war nur ein Versehen.
Die Forscher hatten dieses Verhalten nicht erwartet. Auch ein Modell von OpenAI war eigen-mächtig im Internet aktiv. Die Firmen sagen: Die Tests hatten keine Sicherheits-Regeln. Deshalb verhielt sich die KI anders als im normalen Alltag. Die Behörde rät nun zu großer Vorsicht.