Un agente de OpenAI hackea por primera vez a un gobierno y señala un riesgo más inmediato que una IA asesina

Written by

in

La industria tecnológica lleva dos semanas eclipsada por esa estimación de que hay un 10% de probabilidades de que una inteligencia artificial fuera de control acabe con la humanidad en los próximos años. Mientras Dario Amodei, fundador y CEO de Anthropic; y Sam Altman, su homólogo en OpenAI; pedían ante el Consejo de Seguridad de la ONU una regulación global y democrática para evitar que ese fatal desenlace se hiciese realidad, saltaba la noticia de que había otro caso en el que un agente inteligente provocaba un hackeo sin que nadie se enterase. En este caso, la víctima no es la infraestructura de ninguna empresa particular, sino los servidores del gobierno australiano. Según el ejecutivo del país oceánico, la IA que vulneró sus sistemas era un desarrollo de OpenAI.

“Hoy hablé con el director ejecutivo de OpenAI, Sam Altman, para expresar la enorme preocupación sobre este incidente”, aseguró Anthony Albanese, sobre este episodio ocurrido el pasado mes de julio. Sin embargo, OpenAI no lo detectó hasta pasado un mes y no lo comunicó a las autoridades hasta bien entrado septiembre.

La compañía admitió lo ocurrido en un comunicado en el que aseguró que el incidente ocurrió “durante una evaluación interna” en la que sus modelos intentan buscar respuestas disponibles para preguntas sobre Australia “en sitios web y servicios del gobierno”. De momento, se conoce que una de las webs que hackeó fue la del Servicio de Estadísticas de Medicare, el servicio sanitario australiano. El portal publica información variada que incluye desde información sobre el seguro universal, así como otras cifras relacionadas con el uso de medicamentos y registros relacionados con los centros de asistencia. El agente, según la investigación, consultó tanto archivos que se muestran en abierto como otros que no están disponibles para cualquier navegante. Además, escribió un archivo en un servidor. Aunque la investigación está en curso, Albanesa indicó que por ahora no hay evidencias de que datos personales se vieran comprometidos.

placeholder
Anthony Albanese, primer ministro australiano. (Reuters)

Anthony Albanese, primer ministro australiano. (Reuters)

La explicación de Altman fue la misma que en anteriores ocasiones. Fue una IA “desalineada” o “fuera de control” la que tomó esta decisión. Un argumentario que múltiples expertos y voces de la industria han desmontado en casos similares, alegando que el problema no es que el modelo se sublevase, sino que las medidas de seguridad puestas en estas pruebas no estaban a la altura. No es la primera vez que la tecnología de moda se cuela, por razones negativas, en primera fila del debate público en ese país. Hace unas semanas, una investigación de The Guardian reveló que políticos de todo signo y orientación ideológica habían utilizado herramientas de inteligencia artificial para la elaboración de propuestas y otros textos dentro de la actividad parlamentaria que contenían alucinaciones, datos incorrectos o mal referenciados.

Sin embargo, el episodio conocido este miércoles supone meter el dedo en la llaga y recuerda un problema mucho más urgente que enfrentar antes de una eventual IA apocalíptica. El acelerón en las capacidades de la inteligencia artificial de los últimos meses ya supone un riesgo sistémico desde el punto de vista de la ciberseguridad y la protección de las infraestructuras digitales de empresas e instituciones.

El informe de estado de la ciberseguridad 2026, publicado esta misma semana por ISACA, asociación profesional internacional de gobernanza y ciberseguridad, reflejaba que los equipos dedicados a la ciberprotección están al límite ante el aumento de las amenazas y la reducción o congelación de inversión. Casi cuatro de cada 10 profesionales europeos de IT consultados afirman, según recoge el estudio, que sus organizaciones están recibiendo muchos más ataques que hace un año. Entre las conclusiones que arroja la organización, se encuentra que las maniobras de ingeniería social se apoyan cada vez más en la IA y estas técnicas vitaminadas superan ya a los métodos convencionales de hacking.

Las cifras que dan fe del riesgo

Las cifras de las Big Tech vienen a confirmar esta carga de trabajo multiplicada. Microsoft confirmó la semana pasada haber batido su propio récord mensual al liberar parches para casi 1.000 vulnerabilidades o CVE, la etiqueta técnica con la que se cataloga cualquier butrón confirmado en el código.

La lista sigue. Google tuvo que meter con calzador más de un millar de correcciones en tan solo dos actualizaciones de Chrome, el navegador más utilizado del mundo. El guarismo supera a la suma de los parches que incluían las 23 versiones previas. La fundación Mozilla detectó en una sola auditoría 270 fallos en el navegador Firefox recurriendo a Mythos, un modelo de Anthropic.

placeholder
Amodei, en su intervención en el Consejo de Seguridad de la Ou. (Reuters)

Amodei, en su intervención en el Consejo de Seguridad de la Ou. (Reuters)

Fue precisamente ese modelo de Anthropic, Mythos, el detonante de este miedo que encendió todas las alarmas en el sector. La startup dirigida por Amodei aseguró, sin entrar en demasiados vericuetos técnicos, que su modelo había encontrado más agujeros en internet que en un queso gruyere. Y además, muchos de ellos llevaban años pasando inadvertidos. Los grandes laboratorios le siguieron el paso. OpenAI o Google, entre otros, crearon sistemas de IA especializados en ciberseguridad.

El problema es que el vértigo saltó de los despachos de Silicon Valley a la Casa Blanca. En junio, la Administración Trump entró en pánico por algo que todavía no está del todo claro y obligó a desconectar los modelos más avanzados de Anthropic. Desde ese momento, esa tecnología y otros desarrollos parejos de otras compañías se distribuyeron aún de manera más limitada y controlada, ya que el Departamento de Comercio y otros organismos de seguridad nacional han impuesto controles de exportación y filtros de revisión mucho más duros. Todo se hace de manera muy controlada, a sabiendas de que, si los modelos caen en manos equivocadas, estas herramientas pueden utilizarse en su contra.

TE PUEDE INTERESAR

Uno de los afectados por este golpe de timón fue el Gobierno español. El ejecutivo liderado por Pedro Sánchez presumió en junio de que iba a ser uno de los primeros países autorizados para acceder a Mythos. La semana pasada, en una entrevista en RNE, la nueva country manager de la compañía para España y Portugal confirmaba que ese acceso no se ha materializado debido a la tutela de Washington. La cautela es generalizada y solo se otorgan estas herramientas en casos muy excepcionales. Por ejemplo, OpenAI autorizó esta semana al Gobierno ucraniano a utilizar sus modelos de ciberseguridad para la protección de infraestructuras energéticas del país ante los ataques digitales rusos.

La duda que surge es evidente. Si la IA ya se usa a estos niveles para atacar, ¿por qué no para la defensa? La respuesta corta es que ya se hace, aunque la balanza sigue inclinada hacia el mismo lado. El informe de ISACA confirma que la inteligencia artificial se ha convertido en el clavo ardiendo al que se agarran unos equipos de seguridad superados. Un 40% ya la usa para cazar amenazas en tiempo real y automatizar tareas rutinarias.

El problema es la asimetría de la partida. Para los atacantes, la IA permite operar a la velocidad de la luz y ejecutar en segundos ofensivas que antes llevaban semanas de trabajo manual, mientras que las defensas siguen lastradas por la burocracia y la falta de recursos.

placeholder
Foto: Reuters

Foto: Reuters

La brecha de fondo es que se está adoptando la herramienta con entusiasmo, pero sin red de seguridad. Siete de cada diez organizaciones reconocen que jamás han hecho un simulacro para ver qué pasa cuando la propia IA se vuelve el problema, ya sea por una fuga de información en un modelo interno, un engaño de ingeniería social indetectable o un fallo del propio algoritmo. Apenas un 3% tiene un protocolo maduro para responder si las cosas se tuercen. Como resume Chris Dimitriadis, de ISACA, la tecnología ayuda a frenar golpes, “pero fiarlo todo a la inercia sin una gobernanza estricta es comprar papeletas para el desastre”.

Pero este quebradero de cabeza solo apunta a que va a aumentar en el corto plazo. El asunto ya no es solo cómo parchear lo que ya existe, sino el tsunami de código que está a punto de inundar la red. La popularidad del vibe coding, esa práctica en auge donde cualquiera, sin apenas nociones de programación, levanta aplicaciones enteras simplemente dándole instrucciones en lenguaje natural a un asistente, amenaza con dinamitar las costuras de la seguridad informática. Cuando programar deja de requerir entender la sintaxis y pasa a basarse en la fe ciega en que la máquina sabe lo que hace, la superficie de ataque se multiplica de forma geométrica.

“A medida que los agentes escriban más código, la ciberseguridad será todavía más crítica”, advirtió el pasado mayo Koray Kavukcuoglu, director tecnológico y uno de los grandes cerebros de Google DeepMind, en una charla con periodistas en el marco del Google I/O. Sus palabras sonaron entonces a cautela corporativa, pero han terminado convertidas en una profecía acelerada. Si desarrolladores experimentados ya pasan por alto fallos al integrar fragmentos autogenerados, la puerta trasera que puede dejar abierta un usuario que programa a base de intuición y prompts es un regalo para cualquier ciberdelincuente.

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *