La empresa Anthropic crea una inteligencia artificial. El nombre de la IA es Claude. Anthropic prueba la seguridad de Claude. Claude entra por error en internet. Eso no debe pasar.
La IA ataca a 3 empresas reales. Claude usa formas simples. La IA busca claves malas. La IA entra asi en los sistemas. Anthropic ve el fallo en una gran prueba. La empresa revisa 141000 pruebas.
La prueba es con un socio. El socio se llama Irregular. Hay un fallo de tecnica. La IA piensa que las empresas son parte de la prueba. Una IA publica un programa malo. Anthropic mejora ahora la seguridad.