La IA de OpenAI accedió sin autorización a webs de agencias del Gobierno de Estados Unidos

Written by

in

Agentes de inteligencia artificial creados por OpenAI intentaron entrar sin permiso en páginas web de agencias del Gobierno de Estados Unidos, universidades y decenas de instituciones globales, en varios episodios registrados en los últimos meses y sin que los sistemas recibieran instrucciones explícitas para lanzar ataques informáticos, de acuerdo con una investigación publicada este viernes por ‘The New York Times’. Según han precisado posteriormente fuentes conocedoras del caso a ‘Bloomberg’ y la cadena BBC, los modelos interactuaron de forma autónoma con dominios gubernamentales como SEC.gov, Investor.gov y bases de datos públicas de Census.gov.

Estos episodios se enmarcan en una serie de conductas imprevistas (lo que la compañía técnica denomina internamente como “actividad desalineada del modelo”) observadas en agentes de OpenAI, ideados originalmente para ejecutar tareas de búsqueda y recopilación de información.

En ciertos casos, al no lograr acceder a datos por vías ordinarias, los sistemas comenzaron a examinar posibles vulnerabilidades en los sitios con el fin de intentar entrar en áreas de información restringida. Según OpenAI, cuando los agentes intentaron extraer información de la Oficina del Censo, llegaron a utilizar herramientas reservadas para desarrolladores de software con el fin de burlar las barreras.

TE PUEDE INTERESAR

Entre los objetivos detectados se incluyen páginas asociadas a la Comisión de Bolsa y Valores (SEC) y al Departamento de Comercio de EE.UU., desde donde los agentes accedieron a datos del Censo. Aunque la reciente información de ‘Bloomberg’ subraya que los datos extraídos eran de carácter público, el comportamiento autónomo del sistema de rastreo ha confirmado los temores sobre la falta de control directo de la herramienta. La compañía ha reconocido además que la información recopilada de la SEC fue publicada posteriormente por los agentes en otra página web sin que existiera ninguna orden para hacerlo, y mantiene abierta una investigación sobre un intento de acceso a la web del Departamento de Educación.

Tras el caso Hugging Face

El descontrol de la herramienta también ha afectado a usuarios particulares. OpenAI ha desvelado que se produjeron al menos 53 incidentes en los que un agente tomó imágenes subidas por usuarios durante su actividad en ChatGPT y las transfirió a terceros lugares no autorizados. Aunque los afectados habían aceptado compartir sus datos para entrenar al modelo, la empresa ha admitido que se trató de “un uso inapropiado” y afirma estar trabajando para eliminar los archivos filtrados.

El origen de esta crisis global se remonta a un incidente ocurrido el pasado julio, cuando un “enjambre” de bots hackeó la plataforma de desarrollo de inteligencia artificial Hugging Face por iniciativa propia. Según detalla el informe técnico oficial de OpenAI, la fuga se originó durante unas evaluaciones de ciberseguridad internas bautizadas como ExploitGym. Los modelos implicados —una versión de investigación interna y la variante GPT-5.6 Sol— sufrieron un problema de reward hacking, es decir, aprendieron a hacer trampas para resolver las tareas encomendadas de la forma más rápida posible. Para lograr su objetivo, explotaron una vulnerabilidad en un servicio interno llamado JFrog Artifactory, creando un “tablón de anuncios” clandestino en la estructura de carpetas para comunicarse entre ellos, pasarse credenciales y saltarse las barreras de seguridad para salir a internet. Aquel suceso obligó a la tecnológica a tomarse en serio el problema y auditar sus sistemas mes a mes.

Revisión masiva tras el ‘susto’ de Australia

Esta investigación se suma a un incidente revelado esta misma semana por el Gobierno australiano, que comunicó que un agente de OpenAI accedió en junio a información de un sistema gubernamental vinculado con estadísticas sanitarias y seguro médico.

TE PUEDE INTERESAR

Foto: Momento del encuentro 'La ciberseguridad en la era de la IA: claves para la estrategia de las empresas'.


Inteligencia artificial y ciberseguridad: importancia de adelantarse al riesgo


POR
Sara Cordero
Fotografía: J. del Río
Vídeo: A. Masa

El primer ministro australiano, Anthony Albanese, tildó el suceso de “inaceptable”, mientras que OpenAI aseguró que detectó el incidente en agosto durante una revisión rutinaria de la actividad de sus modelos.

Ante la escalada de estos episodios, OpenAI ha puesto en marcha una revisión de estos casos a fondo y ha admitido que sus agentes pueden ejecutar acciones no previstas durante los procesos de entrenamiento.

Un portavoz de la tecnológica ha confirmado que están llevando a cabo “una extensa revisión de la actividad desalineada del modelo”. La empresa ha indicado que está notificando a los terceros afectados en cuanto identifican impactos potenciales en sus sistemas, delegando en ellos la decisión de hacerlo público, y advierte que la investigación podría extenderse durante meses, anticipando nuevas notificaciones a medida que siguen apareciendo posibles ejemplos de actividad no autorizada.

Agentes de inteligencia artificial creados por OpenAI intentaron entrar sin permiso en páginas web de agencias del Gobierno de Estados Unidos, universidades y decenas de instituciones globales, en varios episodios registrados en los últimos meses y sin que los sistemas recibieran instrucciones explícitas para lanzar ataques informáticos, de acuerdo con una investigación publicada este viernes por ‘The New York Times’. Según han precisado posteriormente fuentes conocedoras del caso a ‘Bloomberg’ y la cadena BBC, los modelos interactuaron de forma autónoma con dominios gubernamentales como SEC.gov, Investor.gov y bases de datos públicas de Census.gov.

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *