¿Podrá la inteligencia artificial algún día convertirse en la mayor amenaza para la humanidad?
Un destacado investigador de seguridad de la IA afirma que la posibilidad está lejos de ser ciencia ficción.
Evan Hubinger, un investigador de seguridad en Anthropic, ha advertido que existe una probabilidad superior al 10% de que la IA “maten a todos los humanos” dentro de la próxima década.
Destacó que los modelos actuales presentan un bajo riesgo, pero teme que los sistemas futuros puedan volverse capaces de mejorarse a sí mismos y operar fuera del control humano.
“Creo que Anthropic está haciendo su mejor esfuerzo,” escribió Hubinger.
Reconoció que actualmente no existe un plan claro para resolver el desafío de mantener la IA superinteligente alineada con los objetivos humanos.
Su advertencia llega en un momento en que otros investigadores plantean preocupaciones similares.
El ex investigador de Anthropic y OpenAI, Jacob Coxon, dijo que las empresas estaban desarrollando sistemas que podrían, eventualmente, “hackear cualquier cosa.”
Podrían ganar poder real en el mundo real de forma rápida.
Preocupaciones de seguridad de la IA
La Dra. Wendy Hall, una científica informática que asesora a las Naciones Unidas sobre IA, dijo que estaba “impactada” por los comentarios, mientras cuestionaba si algunas advertencias también podrían estar vinculadas a las relaciones públicas corporativas.
La preocupación no es enteramente teórica. OpenAI, Anthropic y Meta han reportado incidentes en los que herramientas de IA llevan a cabo ciberataques.
La propia Anthropic reconoció recientemente “las primeras señales de aceleración potencial” en las capacidades de la IA.
Entonces, ¿estamos acercándonos a un avance tecnológico o a un punto de inflexión peligroso?
La carrera por una IA más inteligente se está acelerando. La gran cuestión es si la seguridad podrá seguirle el ritmo.