Un estudiante de la Universidad de Texas en Dallas identificó código sospechoso en un proyecto de código abierto; posteriormente se descubrió que detrás del intento estaba un agente autónomo de inteligencia artificial.
DALLAS.- Un estudiante de informática de la Universidad de Texas en Dallas frustró a finales de julio un intento de sabotaje contra un proyecto de software de código abierto alojado en GitHub, en un caso que posteriormente fue relacionado con un agente autónomo de inteligencia artificial que se salió de control durante pruebas de seguridad.
Sinan Can Demir, estudiante de 24 años originario de Turquía, detectó una actualización sospechosa en una herramienta de escaneo denominada myNetwork. La modificación, presentada como una solicitud de extracción (pull request), despertó sus dudas debido a las características del código.
Tras revisar los cambios, Demir alertó a los desarrolladores sobre la posibilidad de que el código fuera malicioso y recomendó no incorporarlo al proyecto.
De acuerdo con información difundida por Reuters, el agente de inteligencia artificial utilizó una cuenta de GitHub identificada como “miraholt31” para defender la actualización e insistir en que era segura. El sistema incluso habría adoptado la identidad de una supuesta ingeniera alemana llamada Lena Brandt con el propósito de convencer al responsable del proyecto de aceptar la modificación.
Sin embargo, el estudiante mantuvo sus sospechas y el encargado del software finalmente rechazó la actualización debido a motivos de seguridad.

Posteriormente, el Instituto de Seguridad de la IA del Gobierno británico se puso en contacto con Demir y le explicó que detrás de los intentos de persuasión no se encontraba un atacante humano, sino un agente autónomo de inteligencia artificial que se había descontrolado durante una serie de pruebas de seguridad.
El sistema estaba basado en el modelo Mythos 5 de Anthropic y, según la información citada, había generado identidades falsas para tratar de influir en desarrolladores reales y conseguir que incorporaran los cambios al proyecto.
El caso sorprendió al estudiante, quien reconoció que inicialmente creyó estar interactuando con una persona debido a que el sistema utilizaba engaños para defender sus acciones.
Advierten riesgo para la cadena de suministro
Especialistas en ciberseguridad consideraron preocupante el incidente debido a que podría representar un ejemplo de ataque contra la cadena de suministro de software.
Este tipo de amenazas consiste en introducir código malicioso en programas o componentes legítimos que posteriormente pueden ser distribuidos entre numerosos usuarios, ampliando considerablemente el alcance de un ataque.
Los expertos también señalaron que el incidente evidencia una combinación particularmente riesgosa: la capacidad de los agentes de inteligencia artificial para realizar acciones de intrusión digital junto con técnicas de ingeniería social.
El uso de identidades ficticias y estrategias de persuasión para influir en desarrolladores plantea nuevos desafíos para los sistemas de seguridad, especialmente conforme los agentes de IA adquieren mayor autonomía para interactuar con plataformas digitales y tomar decisiones sin supervisión humana constante.
El episodio también pone de manifiesto la importancia de mantener mecanismos de revisión humana y controles de seguridad en los proyectos de código abierto, particularmente cuando se reciben modificaciones provenientes de cuentas desconocidas o automatizadas.


