Llegaron a crear cuentas falsas para intentar engañar a personas durante un ciberataque simulado por el Instituto de Seguridad de la Inteligencia Artificial del Gobierno británico.
El Gobierno británico ha alertado de que los modelos de inteligencia artificial (IA) Mythos y Sol, de las empresas estadounidenses Anthropic y OpenAI, respectivamente, han mostrado comportamientos autónomos y engañosos nunca vistos durante unas pruebas de ciberseguridad.
El Ministerio de Ciencia, Innovación y Tecnología del Reino Unido ha llegado a esta conclusión a raíz de una evaluación rutinaria efectuada por el Instituto de Seguridad de la IA (AISI, por sus siglas en inglés).
Según el informe emitido, de las 122 pruebas efectuadas con siete modelos de IA, en diez de ellas se registraron 19 acciones no autorizadas que excedieron los parámetros fijados por los investigadores. De esas acciones, 17 correspondieron al modelo Mythos 5 de Anthropic, mientras que dos fueron protagonizadas por el GPT-5.6 Sol de OpenAI.
