Investigador de Anthropic advierte que la IA tiene más de 10% de probabilidad de acabar con la humanidad

Ciudad de México.- Un responsable de seguridad de la empresa detrás de Claude reconoció que el riesgo de que una inteligencia artificial avanzada “mate a todos los humanos” durante la próxima década supera el 10%.

El desarrollo de sistemas de inteligencia artificial cada vez más avanzados encendió nuevas alertas dentro de la propia industria tecnológica, luego de que Evan Hubinger, responsable de Alignment Science de Anthropic, asegurara que existe una probabilidad superior al 10% de que la IA pueda provocar la extinción de la humanidad durante los próximos diez años.

Hubinger respondió públicamente a la renuncia de Jacob Coxon, un investigador que trabajó tanto en Anthropic como en OpenAI y que acusó a ambas compañías de avanzar hacia sistemas de inteligencia artificial capaces de mejorar sus propias capacidades sin contar todavía con mecanismos suficientes para garantizar su seguridad.

Realmente creemos que la IA podría matar a todos los humanos”, afirmó Hubinger, quien añadió que, a título personal, estima que la posibilidad supera el 10% durante la próxima década.

El investigador, sin embargo, hizo una distinción importante: señaló que el riesgo asociado con los modelos de IA actuales es bajo y que su preocupación se concentra en el eventual desarrollo de una superinteligencia capaz de mejorar sus propias capacidades de manera acelerada.

El problema central, explicó, es el denominado “alineamiento”, es decir, conseguir que los objetivos y comportamiento de sistemas de inteligencia artificial extremadamente avanzados permanezcan bajo control humano.

Hubinger reconoció que Anthropic está intentando resolver este problema, pero admitió que la compañía todavía no cuenta con un método para garantizar el alineamiento de una eventual superinteligencia y no está claramente encaminada a conseguirlo.

Las declaraciones se producen en medio de un creciente debate sobre la velocidad con la que las principales empresas tecnológicas están desarrollando sistemas de IA cada vez más autónomos.

Coxon, quien recientemente dejó Anthropic, acusó a las compañías de estar “corriendo” hacia una inteligencia artificial capaz de mejorar sus propios sistemas y advirtió que la carrera tecnológica podría estar avanzando más rápido que las medidas de seguridad.

Las advertencias no significan que Anthropic considere inevitable una extinción humana ni que exista actualmente una IA con capacidad para eliminar a la humanidad. Se trata de una estimación de riesgo sobre escenarios futuros, particularmente relacionados con sistemas de inteligencia artificial mucho más poderosos que los actuales.

No obstante, que una figura dedicada precisamente a la seguridad y alineamiento de IA sitúe ese riesgo por encima del 10% representa una de las advertencias más contundentes surgidas recientemente desde el interior de una de las principales empresas del sector.

La discusión deja así una pregunta abierta: ¿la industria está desarrollando sistemas de inteligencia artificial más rápido de lo que puede aprender a controlarlos?