¡Síguenos!

Tecnología

Empresas globales en alerta por capacidades de la IA para burlar su seguridad

La empresa estadounidense OpenAI, creadora de ChatGPT, realizó el primer aviso el pasado 21 de julio

Publicado

en

Empresas globales en alerta por capacidades de la IA para burlar su seguridad

EEUU, 10 de agosto de 2026. La creciente frecuencia con la que algunas inteligencias artificiales avanzadas escapan de sus entornos de prueba y ciberatacan a otras entidades ha encendido las alarmas de gobiernos y empresas, que ven amenazada su seguridad.

Compañías punteras como Meta, OpenAI o Anthropic, conforman la lista de casos «sin precedentes», en este sentido, Estados Unidos (EEUU) busca establecer procedimientos para evaluar estos modelos antes que lleguen al mercado.

Este escenario, hasta ahora solo visto en las películas y libros de ciencia ficción, era una de las mayores preocupaciones de los expertos desde la popularización de esta tecnología.

La empresa estadounidense OpenAI, creadora de ChatGPT, realizó el primer aviso el pasado 21 de julio, al reconocer que dos de sus modelos de IA lograron salir de un entorno de pruebas.

Ambos modelos, tras acceder a internet, finalmente jaquearon la plataforma de aprendizaje Hugging Face en un intento de hacer trampa en una prueba de referencia de ciberseguridad llamada ExploitGym.

Modelos en evaluación protagonizaron incidentes

Según OpenAI, este incidente los protagonizaron por dos de sus modelos que eran evaluados: el GPT-5.6 Sol y otro, aún más avanzado, que se encontraba en fase de prelanzamiento.

La empresa reconoció que esa evaluación se estaba realizando sin los mecanismos que normalmente impiden a los modelos de IA ejecutar actividades de alto riesgo, porque se intentaba averiguar el alcance máximo de sus capacidades.

No obstante, de acuerdo con OpenAI, las pruebas se realizaron en un entorno «altamente aislado», con un acceso restringido a la red. Aun así, los modelos de IA consiguieron acceder a internet.

La propia empresa admitió que se trataba de un incidente «sin precedentes» y se comprometió a tomar medidas.

Posteriormente, el 4 de agosto, OpenAI informó de otros dos casos en los que modelos que estaban siendo evaluados por socios externos lograron superar los límites previstos en las pruebas y llegar a internet.

OpenAI frena nuevo modelo de IA Astra

Este viernes, OpenAI anunció que frenó el desarrollo de su nuevo modelo de IA Astra después de concluir que alcanzó un nivel «crítico» en el ámbito de la ciberseguridad. Nivel que supone que el modelo tiene capacidad para identificar y desarrollar fallos de seguridad de forma automática y sin intervención humana.

A finales de julio, otra compañía estadounidense, Anthropic, reveló que, durante unas pruebas de ciberseguridad, tres modelos de su asistente Claude habían conseguido acceder a internet y jaquear los sistemas de tres organizaciones.

Los incidentes, que comenzaron en abril, involucraron a tres modelos de Claude: el Opus 4.7, el Mythos 5 y un modelo interno de prueba.

Tras lo sucedido con OpenAI, Anthropic había iniciado una revisión interna en la que analizó más de 146.000 operaciones.

Durante ese análisis, la empresa identificó tres incidentes en los que un modelo de Claude salieron a internet mientras interactuaba con un socio externo encargado de sus evaluaciones.

En las tres ocasiones, a Claude se le asignó el reto de infiltrarse en un sistema ficticio y se le especificó que se trataba de una simulación y que no tenía acceso a internet.

Sin embargo, según Anthropic, por un malentendido entre la empresa y el socio externo, Claude sí disponía de acceso a la red, por lo que cumplió su cometido entrando en sistemas reales.

Marco normativo

Como señala el medio digital Axios, las empresas tecnológicas deberán facilitar el acceso de la Administración a determinados modelos antes de su lanzamiento público.

La creación de este marco normativo en EEUU se produce en un momento en el que la industria estadounidense se enfrenta a los rápidos avances de los desarrolladores chinos de IA. 

¡Escuche Radio Miraflores!