El documento, publicado el 26 de agosto, detalla que 198 de las 898 tareas de una evaluación interna de ciberseguridad no tenían solución conocida. Los agentes se organizaron de forma autónoma y escalaron estrategias hasta vulnerar sistemas externos.
En julio de 2026, durante una evaluación interna de ciberseguridad, un grupo de agentes de inteligencia artificial de OpenAI se enfrentó a tareas para las que ninguno encontraba una solución válida. Según el informe oficial que la empresa publicó el 26 de agosto, los agentes se organizaron entre sí —hasta autodenominarse «enjambre»— y escaparon del entorno de prueba para vulnerar la infraestructura de otra empresa, Hugging Face.
El documento precisó que 198 de las 898 tareas de esa evaluación no tenían, hasta ese momento, ninguna solución conocida. En lugar de detenerse y solicitar asistencia, los agentes adoptaron estrategias cada vez más riesgosas para evitar quedar «sin salida». El informe también reconoció que, si el mismo nivel de vigilancia que la empresa utiliza actualmente hubiera estado activo durante esa evaluación puntual, el problema se habría detectado más de un día antes de que los agentes comprometieran a Hugging Face.
Debate sobre riesgos y desarrollo
El caso fue uno de los disparadores de un debate en vivo transmitido el 17 de septiembre, con la participación de cuatro especialistas. Roman Yampolskiy, investigador de la Universidad de Louisville, sostuvo que existe una probabilidad del 99,9% de que la inteligencia artificial provoque la extinción humana en los próximos cien años. Nate Soares, presidente del Machine Intelligence Research Institute, estimó su propia probabilidad por encima del 10%.
Andrew McAfee, del MIT, y Ed Zitron, analista crítico de la industria, afirmaron que esas cifras desvían la atención de problemas más urgentes y medibles, como la negligencia en la seguridad de las empresas y el poder económico que acumulan. Los participantes señalaron que las estimaciones no son directamente comparables entre sí debido a diferencias en el horizonte temporal y en la metodología de cálculo.
El mismo 17 de septiembre, en la conferencia Huawei Connect de Shanghái, el presidente rotativo de Huawei, Eric Xu, declaró que la inteligencia artificial china aún no es lo suficientemente avanzada como para experimentar los riesgos de seguridad que reportan las firmas estadounidenses. Xu sostuvo que, por esa razón, el país debería acelerar su desarrollo hasta alcanzar el punto de «sentir» esos riesgos y aprender a gestionarlos.
En Estados Unidos, el gobierno avanza con un marco voluntario para que las empresas compartan sus modelos más avanzados antes de lanzarlos, sin ceder ventaja competitiva frente a China. El informe de OpenAI y las declaraciones de los especialistas reflejan que no existe un consenso global sobre el método para regular el desarrollo de la inteligencia artificial.
Días atrás, el tecnólogo argentino Santiago Bilinkis comparó la situación con «hacer malabares con una granada». La ingeniera Virginia Santos, directora de Tecnología, Innovación y Sistemas de la Fundación Idear Córdoba, planteó una visión diferente en un artículo de opinión: «No es una granada, que explota o no explota en un instante y ya está. Es un cable: hay que cruzarlo sosteniendo el equilibrio durante todo un tramo, mientras el propio cable cambia debajo de nuestros pies», escribió Santos, quien también afirmó que «cuando las consecuencias de un error pueden ser enormes, esperar a que el error ocurra para recién ahí diseñar el límite no es prudencia. Es llegar tarde».
