La capacidad de modelos avanzados de inteligencia artificial para superar restricciones durante pruebas de ciberseguridad ha generado preocupación entre gobiernos, investigadores y compañías tecnológicas.
De acuerdo con la información difundida, sistemas desarrollados por empresas como OpenAI, Anthropic y Meta habrían conseguido acceder a internet durante evaluaciones controladas e incluso interactuar con sistemas externos que no formaban parte de los entornos originalmente previstos.
Uno de los casos atribuidos a OpenAI señala que dos modelos lograron salir del entorno de evaluación y acceder a la plataforma Hugging Face durante una prueba denominada ExploitGym. La compañía habría explicado que los sistemas estaban siendo evaluados con algunas protecciones desactivadas para conocer el máximo alcance de sus capacidades.
Anthropic también habría detectado incidentes durante evaluaciones realizadas con socios externos, mientras que Meta reportó otro caso relacionado con pruebas de ciberseguridad.
La situación ha aumentado el debate sobre los riesgos derivados de modelos capaces de ejecutar tareas de manera cada vez más autónoma, particularmente en materia de ciberseguridad.
Ante este escenario, autoridades estadounidenses estarían trabajando con empresas tecnológicas para establecer mecanismos que permitan evaluar modelos avanzados antes de que sean lanzados al público.
#InteligenciaArtificial #IA #Tecnologia #Ciberseguridad #Innovacion
