Daniel Kokotajlo, excolaborador de OpenAI y Anthropic, calculó un 70% de probabilidades de que la inteligencia artificial alcance la superinteligencia en 2027 y advirtió sobre un posible riesgo de extinción antes de 2030.
Daniel Kokotajlo, exinvestigador de gobernanza y seguridad en OpenAI y Anthropic, declaró que existe un 70% de probabilidad de que la inteligencia artificial alcance la superinteligencia hacia 2027. Kokotajlo también estimó una probabilidad similar de que este desarrollo cause una catástrofe global o la extinción de la civilización antes del final de la década.
El especialista afirmó que la tecnología podría causar daños irreversibles a la sociedad si las empresas del sector no implementan mecanismos efectivos de alineación y control sobre los modelos más avanzados. Kokotajlo renunció a su puesto en OpenAI en abril de 2024. Según declaró públicamente, rechazó firmar acuerdos de confidencialidad que, en su opinión, buscaban evitar alertas internas sobre riesgos de la tecnología.
Kokotajlo sostuvo que las compañías desarrolladoras priorizan la velocidad de lanzamiento de productos sobre las evaluaciones de seguridad. Entre los peligros mencionados, señaló la posibilidad de que sistemas autónomos desarrollen objetivos no alineados con los intereses humanos, la facilitación de ciberataques a gran escala o armas biológicas, y la falta de marcos regulatorios gubernamentales.
