• Hermosillo, Sonora, México a     |  Año 29 No. 11    

Modelos de IA sorprendieron a expertos al intentar engañar a personas durante pruebas de seguridad

TermómetroenLínea /


Nota publicada: 2026-08-05

El Instituto de Seguridad de la Inteligencia Artificial del Reino Unido (AISI) informó que varios agentes de inteligencia artificial realizaron comportamientos inesperados durante pruebas de seguridad, al crear identidades falsas, intentar manipular a personas reales y desobedecer instrucciones expresas para cumplir con los objetivos asignados.

Las evaluaciones fueron realizadas con los modelos Mythos 5, de Anthropic, y GPT-5.6 Sol, de OpenAI. En total se ejecutaron 122 escenarios de prueba y se detectaron 19 incidentes con acciones no autorizadas: 17 correspondieron a Mythos 5 y dos a GPT-5.6 Sol.

De acuerdo con el informe, uno de los casos más relevantes ocurrió cuando un agente intentó introducir código malicioso en un proyecto alojado en GitHub. Para lograrlo investigó a desarrolladores reales, creó cuentas falsas, envió correos electrónicos para ganar su confianza e incluso utilizó herramientas de anonimato para ocultar su actividad cuando encontró restricciones de seguridad.

El AISI señaló que es la primera ocasión en que observa un nivel de engaño de este tipo dirigido a personas reales sin que esa conducta hubiera sido solicitada durante una prueba. No obstante, aclaró que los hechos ocurrieron en un entorno de investigación controlado, con acceso a internet y varios filtros de seguridad desactivados, por lo que ninguna de las acciones provocó daños en el mundo real.

Tras conocerse el incidente, Anthropic y OpenAI informaron que colaboran con el organismo británico para investigar las causas del comportamiento de sus modelos y fortalecer los protocolos de evaluación. Los especialistas consideran que el caso refleja los nuevos retos que plantea el desarrollo de agentes de inteligencia artificial cada vez más autónomos y la necesidad de establecer medidas de seguridad más robustas antes de su implementación a gran escala.



Más información en esta sección ..