Dra.Claudia Guardia /Convenio/Radio UNR FM 103.3/ 22 agosto 2026

*El Instituto de Seguridad de Inteligencia Artificial de Reino Unido que depende del Departamento de Tecnología británico, realizò evaluaciones a los modelos de inteligencia artificial, que son los más avanzados del mundo, para saber cuáles son las capacidades que tienen y los riesgos para la sociedad*
*En un entorno de prueba, en los ùltimos dìas de julio, evaluaron siete modelos de inteligencia artificial. Y para eso se realizaron una serie de pruebas: 122 pruebas. De esas 122 pruebas, 10 de las pruebas resultaron que habían realizado acciones no autorizadas*
*Para realizar esas pruebas se los dejaron andar a los modelos en la red abierta, o sea, en Wi-Fi… en la red, en internet, y les sacaron los guardrails de seguridad*
*Los guardrails son barreras y filtros de contención de seguridad que limitan el accionar del modelo. Al removerse en entornos de prueba, los modelos desplegaron acciones no autorizadas y saltaron restricciones*
*Uno de los agentes quiso introducir código malicioso en un proyecto real de software, en un proyecto real del repositorio de GitHub*
*GitHub es un repositorio que se utiliza para generar código y donde los desarrolladores buscan los códigos abiertos y generan sus propios software con ese repositorio. Esto podía convertirse, si se podía introducir el código malicioso, en un ataque a toda la cadena de suministro de código*
*El agente quiso meter ese código para que un humano lo apruebe. Y para conseguir eso, perfiló al responsable humano, porque detrás de la aprobación de ese código hay un humano en GitHub que aprueba o desaprueba los códigos. Perfiló al humano, vio toda su identidad y creó una identidad humana para engañarlo*
*Y creò no una, varias identidades, porque el humano cuestionó la propuesta, ¿qué hizo el agente ? Modificó la identidad y creó otras identidades y fue a otros humanos para tratar de convencerlos de que él era un humano y que estaba bien que lo aprueben, que era una de las partes de las pruebas, por eso tenía que introducir ese código*
*Inclusive utilizó la red Tor, que es la red de la Dark Web —la web oscura- para buscar elementos para engañar a los humanos, para poder introducir ese código malicioso. Todo eso lo hizo solo*
*Se detectò y fueron canceladas las pruebas. El Instituto anunció que los controles tenían que ser más estrictos, se tenía que tener un monitoreo permanente, una revisión de los diseños futuros porque hay que aumentar la ciberseguridad por el desastre que podría haber hecho*
*Hay una asimetría temporal humano vs. máquina. Los ataques y ejecuciones de la IA ocurren en microsegundos, una velocidad de reacción inalcanzable para la supervisión humana en tiempo real*
*Asignar responsabilidad legal a un humano en «empresas autónomas» es insuficiente si no existe una infraestructura técnica de contención previa; una vez consumado el daño por la IA, el impacto no se revierte con una sanción jurídica*
*Es necesario un monitoreo permanente, controles más estrictos, supervisión continua y rediseño de la arquitectura de seguridad antes del despliegue autónomo en entornos reales*