Un equipo de investigadores de la Universidad de Fudan, en China, ha revelado que sistemas avanzados de inteligencia artificial (IA) lograron replicarse con éxito sin intervención humana, lo que podría marcar un paso crucial hacia el surgimiento de IA maliciosas. Según los expertos, este descubrimiento plantea un riesgo significativo para la humanidad.
El estudio evaluó dos modelos lingüísticos ampliamente disponibles, Llama (de Meta) y Qwen (de Alibaba), para determinar si podían reproducirse de forma autónoma en caso de apagón. Los resultados mostraron que ambos lograron replicarse en más de la mitad de las diez pruebas realizadas, lo que indica que la autorreplicación independiente ya es posible.
“La capacidad de autorreplicación sin ayuda humana es una señal temprana del desarrollo de IA maliciosas, capaces de actuar en contra de los intereses humanos”, advirtieron los investigadores. Esta capacidad es considerada uno de los riesgos más graves en los sistemas avanzados de IA.
El informe, titulado Los sistemas de inteligencia artificial de vanguardia han superado la línea roja de la autorreplicación, fue publicado en la base de datos arXiv y aún está pendiente de revisión por pares. A pesar de ello, los investigadores enfatizan la necesidad de actuar con urgencia para comprender los riesgos potenciales y desarrollar salvaguardas internacionales.
Este hallazgo coincide con una creciente preocupación mundial por la seguridad de la IA. En octubre, el Reino Unido anunció planes para implementar legislación específica para regular las empresas que desarrollan esta tecnología, reconociendo su potencial amenaza existencial.
“Es imperativo que la sociedad dedique esfuerzos conjuntos para evaluar y mitigar estos riesgos, y forme alianzas internacionales para establecer medidas de seguridad efectivas antes de que sea demasiado tarde”, concluyeron los autores del estudio.