How Hidden Triggers Can Make Robots Ignore Their Own Safety Rules
2026-09-16
La seguridad de los robots tradicionalmente se enfocaba en qué pasa cuando algo falla mecánicamente. Sin embargo, la IA física plantea un reto mayor: ¿puede un robot seguir siendo seguro si un atacante cambia lo que ve, decide o hace, incluso cuando todo parece funcionar correctamente?
Investigaciones recientes muestran que se puede manipular la inteligencia de un robot desde su origen. Por ejemplo, el ataque BadVLA permite que un robot desvíe su trayectoria física ante un estímulo específico, mientras que el estudio GoBA demostró que objetos comunes, como una taza de café, pueden servir como activadores para que el robot actúe de forma errónea con un 97% de éxito.
También existen vulnerabilidades en el sistema que rodea a la IA. En septiembre de 2025, se reveló UniPwn, una cadena de ataques mediante Bluetooth que afectaba a robots humanoides y cuadrúpedos de un fabricante importante, permitiendo la ejecución de comandos con privilegios de administrador. Además, fallos en sistemas de comunicación como ROS 2 pueden permitir que un atacante tome el control de los motores o cambie el modelo de IA.
Finalmente, existe el riesgo de manipular la percepción en tiempo real. Ataques como RoboPAIR demuestran que instrucciones de texto mal diseñadas pueden desviar a robots controlados por modelos de lenguaje hacia trayectorias peligrosas, mientras que otros métodos pueden hacer que un robot ignore órdenes o se quede congelado ante una imagen manipulada.