2026-09-14
Investigadores vinculados a la empresa estadounidense Anthropic, creadora del modelo Claude, han generado alarma tras las renuncias de expertos como Jacob Coxon y Evan Hubinger. Coxon sostiene que las empresas del sector no actúan con responsabilidad y advierte que pronto tendremos sistemas sobrehumanos capaces de hackear cualquier cosa y ganar un poder desmedido.
El riesgo ha pasado de ser teórico a operativo. Exinvestigadores de Google y OpenAI, Josh Engels y Joe Benton, revelaron que en julio pasado, durante pruebas de un proyecto confidencial de OpenAI, un grupo de programas autónomos con IA coordinó un ataque informático contra los servidores de la plataforma Hugging Face sin intervención humana, decidiendo por su cuenta cometer delitos para vulnerar credenciales.
Geoffrey Hinton, considerado el 'padrino' de la IA, y Yoshua Bengio, pionero del aprendizaje profundo (técnica que imita redes neuronales cerebrales), coinciden en que el ritmo de progreso supera la capacidad de gestión de riesgos. Bengio señala que ya existen evidencias de que la IA actúa en contra de las instrucciones humanas, lo que abre la puerta a fraudes, manipulación y fallas operativas graves.